Claude가 11일 만에 완성한 페르마의 마지막 정리 형식 증명
Anthropic의 Claude가 11일 동안 거의 자율적으로 작업하며 페르마의 마지막 정리의 첫 컴퓨터 검증 증명을 완성했다. 1,300만 줄의 Lean 코드로 29,500개 이상의 수학 정리를 증명한 이번 성과는 AI 지원 수학 형식화의 새로운 장을 열었다.
원문: Claude Formalizes Fermat's Last Theorem in 11 Days — A 350-Year Mathematical Milestone 원문 보기 →
350년 난제의 형식적 완성
Anthropic이 9월 5일 공개한 연구에 따르면, Claude는 지난 8월 11일 동안 거의 완전히 자율적으로 작동하며 페르마의 마지막 정리(Fermat's Last Theorem)의 첫 컴퓨터 검증 증명을 완성했다. 1637년 피에르 드 페르마가 제시하고 1995년 앤드루 와일스가 증명한 이 정리를, AI가 형식 언어로 완전히 재구성한 것은 수학사에서 전례 없는 일이다.
1,300만 줄의 Lean 코드
Claude는 정리 증명 보조 도구인 Lean 언어로 총 1,300만 줄의 코드를 생성했다. 이는 수학 형식화 커뮤니티의 표준 라이브러리인 Mathlib 전체 크기의 5배에 달하는 방대한 분량이다. 최종 증명에는 29,500개의 중간 정리가 포함되며, 대수학·조화해석학·기하학·정수론 등 여러 수학 분야를 아우른다.
전문가 검증
임페리얼 칼리지 런던의 케빈 버저드(Kevin Buzzard) 교수는 이 증명이 "수학의 공리 외에 다른 전제 없이 페르마의 마지막 정리를 증명한다"고 확인했다. 버저드 교수는 "FLT의 자동 형식화가 지금 가능하다면, 현대 수학 문헌의 자동 형식화를 향한 큰 발걸음"이라며 오류 검증과 동료 심사의 부담을 크게 줄일 수 있다는 점에 주목했다.
약 60억 출력 토큰
Claude는 이 작업에 약 60억 개의 출력 토큰을 소비했다. AI가 단순한 코드 생성이나 문서 요약을 넘어 전문 수학자도 수년이 걸릴 복잡한 지적 작업을 자율적으로 수행할 수 있음을 보여주는 이정표 사례다.
관련 기사
Claude, 리만 제타 영점 하한을 41.6%에서 67.2%로 끌어올린 검증 가능 증명 공개
미해결 난제 자체를 풀지는 못했지만, Claude는 리만 가설을 만족하는 제타 함수 영점의 알려진 하한을 41.6%에서 67.2%로 높였다. 3,100만 출력 토큰과 약 60개 하위 에이전트를 동원한 결과다.
Claude, 단백질 표적 15개 중 14개 결합 성공·최대 적중률 35.1% 실험 검증 완료
Claude가 설계한 단백질 결합체가 15개 표적 중 14개에서 실험적으로 작동했다. 적중률은 22.6~35.1%로 일반적인 설계 캠페인의 10~15%를 웃돌았지만, 최대 12,500 H100 시간과 전문 오픈소스 모델이 투입됐다.
Claude의 단백질 결합 설계 실증 — 15개 중 14개 타겟, 적중률 업계 평균의 두 배
Anthropic이 8월 18일 Claude Mythos Preview를 활용한 단백질 결합체 설계 연구를 발표했다. 15개 표적 중 14개에서 결합 성공이 확인됐으며, 적중률 26.7%는 업계 표준(10~15%)의 두 배를 기록했다. Adaptyv Bio와 Twist Bioscience의 독립 실험실 검증을 통과했다.