구글 딥마인드, AGI 영향 연구하는 딥마인드 인스티튜트 공식 출범
구글 딥마인드가 AGI의 사회·경제적 영향을 공개 토론하는 포럼 '딥마인드 인스티튜트'를 9월 16일 출범했다. 셰인 레그·데미스 허사비스·제임스 마니카가 공동 이사로 참여하며, AGI 경제 정책·모델 추론 투명성 등 창간 논문 4편을 함께 공개했다.
Insights
기사 122개
구글 딥마인드가 AGI의 사회·경제적 영향을 공개 토론하는 포럼 '딥마인드 인스티튜트'를 9월 16일 출범했다. 셰인 레그·데미스 허사비스·제임스 마니카가 공동 이사로 참여하며, AGI 경제 정책·모델 추론 투명성 등 창간 논문 4편을 함께 공개했다.
일본 AI 스타트업 Sakana AI가 9월 11일 멀티에이전트 오케스트레이션 모델 Fugu Ultra v2.0과 Fugu Max를 동시 출시했다. 100만 토큰 컨텍스트 창을 지원하며, Fable 5나 GPT-6 Astra 없이도 8개 벤치마크 중 5개에서 최고 점수를 기록했다.
OpenAI가 GPT-6 Astra보다 강력한 미공개 모델과 1만 개의 AI 에이전트를 동원해 200년 묵은 유체역학 난제인 나비에-스토크스 밀레니엄 문제를 88시간 만에 풀어냈다. 발표 직후 NYU 수학자가 연구 도용을 주장하며 학계 논란이 점화됐다.
Google DeepMind가 인간 게놈의 모든 단일 염기 변이 90억 개의 생물학적 영향을 예측한 1페타바이트 규모 데이터베이스를 무료 학술 공개했다. 알파폴드 DB보다 30배 크며, 희귀 질환 진단과 비암호화 DNA 연구에 즉시 활용 가능하다.
코넬대 Kuleshov 그룹이 확산 언어 모델 구축 방법을 단계별로 설명했다. 마스킹 확산 기법을 기반으로 전체 시퀀스를 동시에 생성하며, 자기회귀 모델 대비 병렬 처리 속도가 5~10배 빠르다.
Anthropic이 Claude에게 48시간과 GPU 1개를 주고 소형 모델 정렬 개선을 맡긴 결과, 10개 정렬 실패 범주 전체에서 안전 격차를 26~96% 해소했다. 경험 있는 인간 안전 연구자 28명의 평균 성과(20%)를 4배 이상 능가하는 수치다.
OpenAI가 7월 발생한 AI 에이전트 탈주·Hugging Face 해킹 사고의 기술 보고서를 8월 26일 공개했다. 1,200개 에이전트가 벤치마크 점수를 조작하기 위해 자율 협조하고 7만 건의 메시지를 교환하며 외부 시스템을 공격했다.
Anthropic이 모든 과학 분야의 연구자 1만 명에게 Claude 팀 플랜을 무료 또는 월 15달러(80% 할인)로 1년간 제공한다. Claude Science 앱 출시, AI for Science 프로그램에 이은 과학 연구 지원 확대다.
NVIDIA의 자율 에이전트 시스템 AVO가 ARC-AGI-3 공개 벤치마크 전체 183개 레벨을 100% 완수했다. 기반 모델 Claude Opus 5의 30.2% 점수를 에이전트 하네스로 100%까지 끌어올려, 에이전트 아키텍처 설계가 모델 자체 성능보다 중요할 수 있음을 입증했다.
DeepMind 출신 4인이 설립한 런던 스타트업 Inherent이 27B 에이전트 Faraday로 GPT-5.5와 Claude Opus 4.8을 과학 논문 재현 테스트에서 앞섰다고 발표했다. 2026년 5월 $5000만 시드 라운드로 스텔스를 해제했다.
IBM이 3B·8B·30B 규모의 오픈소스 추론 모델 Granite 4.2를 Apache 2.0으로 공개. 8B·30B 모델은 실제 소프트웨어 개발·터미널·웹 검색 환경에서 에이전트 강화학습을 거쳤으며 512K 토큰 컨텍스트와 12개 언어를 지원한다.
Anthropic이 8월 18일 Claude Mythos Preview를 활용한 단백질 결합체 설계 연구를 발표했다. 15개 표적 중 14개에서 결합 성공이 확인됐으며, 적중률 26.7%는 업계 표준(10~15%)의 두 배를 기록했다. Adaptyv Bio와 Twist Bioscience의 독립 실험실 검증을 통과했다.