GPT-5.6 Sol, 6큐비트 칩 교정 40건 중 36건 자율 수행…실험실로 들어간 Codex
GPT-5.6 Sol 기반 Codex가 처음 보는 6큐비트 칩의 측정 40건 가운데 36건을 연구자 개입 없이 처리했다. 코드를 쓰는 에이전트가 실험 장비를 조작하고 결과에 따라 다음 측정을 고르는 단계까지 들어갔지만, 약하고 모호한 신호에서는 인간의 판단이 여전히 필요했다.
Insights
기사 154개
GPT-5.6 Sol 기반 Codex가 처음 보는 6큐비트 칩의 측정 40건 가운데 36건을 연구자 개입 없이 처리했다. 코드를 쓰는 에이전트가 실험 장비를 조작하고 결과에 따라 다음 측정을 고르는 단계까지 들어갔지만, 약하고 모호한 신호에서는 인간의 판단이 여전히 필요했다.
실험실에서 하나씩 검사할 수 없던 인간 DNA 단일 염기 변이 90억 개를 탐색 가능한 예측 지도로 묶었다. Google DeepMind의 1PB AlphaGenome Atlas는 AlphaFold Database보다 30배 이상 크며 변이 영향 순위를 단일 AVI 점수로 제공한다.
수학 연구 자동화의 규모가 단숨에 달라졌다. OpenAI의 차세대 내부 모델과 약 1만 개 에이전트가 88시간 동안 협업해 약 90년간 풀리지 않은 Navier–Stokes 문제의 유한시간 특이점 증명과 Lean 형식화를 만들었다. 이제 독립 검증이 관건이다.
Anthropic의 Claude가 11일 동안 거의 자율적으로 작업하며 페르마의 마지막 정리의 첫 컴퓨터 검증 증명을 완성했다. 1,300만 줄의 Lean 코드로 29,500개 이상의 수학 정리를 증명한 이번 성과는 AI 지원 수학 형식화의 새로운 장을 열었다.
16만6000개가 넘는 뉴런과 1억2500만 개 시냅스 연결을 담은 수컷 초파리 뇌·중추신경계 지도가 완성됐다. AI로 전자현미경 절편을 3차원 신경망으로 복원한 이 데이터는 성별에 따른 회로 차이와 감각이 행동으로 이어지는 경로를 한 번에 비교할 기반이다.
WeatherNext 3가 기존 25km·6시간 간격의 세계 예보를 최대 5km·1시간 단위로 세밀화했다. 실시간 위성 자료를 직접 받아 Google 검색·Gemini·Maps·Cloud에 공급해 국지성 비와 재생에너지 예측의 활용도가 커지며 변수별 해상도는 서로 다르다.
전 세계 기상 예보의 갱신 간격이 6시간에서 1시간으로 짧아지고, 지상 기온·습도 해상도는 25km에서 5km로 촘촘해진다. WeatherNext 3는 Google 서비스의 하루 이상 강수 예보 정확도를 최대 50% 높이며 Search·Maps·Gemini와 Cloud에 바로 투입됐다.
Python의 레퍼런스 구현인 CPython이 RISC-V 아키텍처를 티어 3 공식 지원 플랫폼으로 채택했다. RISE 프로젝트의 하드웨어 지원과 커뮤니티 기여자들의 협력으로 이뤄진 성과다.
Anthropic이 모든 과학 분야의 연구자 1만 명에게 Claude 팀 플랜을 무료 또는 월 15달러(80% 할인)로 1년간 제공한다. Claude Science 앱 출시, AI for Science 프로그램에 이은 과학 연구 지원 확대다.
Anthropic이 8월 18일 Claude Mythos Preview를 활용한 단백질 결합체 설계 연구를 발표했다. 15개 표적 중 14개에서 결합 성공이 확인됐으며, 적중률 26.7%는 업계 표준(10~15%)의 두 배를 기록했다. Adaptyv Bio와 Twist Bioscience의 독립 실험실 검증을 통과했다.
Google DeepMind 연구진과 학계가 AlphaEvolve를 활용해 행렬곱 지수의 상한을 2.371339에서 2.371177로 낮췄다. 개선 폭은 0.000162이지만 AI 계산의 핵심 연산에 대한 수십 년짜리 이론 경계를 다시 밀었다.
Claude가 설계한 단백질 결합체가 15개 표적 중 14개에서 실험적으로 작동했다. 적중률은 22.6~35.1%로 일반적인 설계 캠페인의 10~15%를 웃돌았지만, 최대 12,500 H100 시간과 전문 오픈소스 모델이 투입됐다.