60년 묵은 에르되시 문제 풀이, r/singularity가 물은 것 "암기 아닌 새 연결인가"
r/singularity는 “AI가 또 문제를 맞혔다”보다 “이번엔 진짜 새 수가 나온 건가”에 더 꽂혔다. Scientific American이 전한 23세 Liam Price와 GPT-5.4 Pro의 60년 묵은 Erdos 문제 풀이가, novelty와 전문가 정리 작업, 수학자 역할을 둘러싼 토론으로 번졌다.
태그
#mathematics 태그가 달린 기사
r/singularity는 “AI가 또 문제를 맞혔다”보다 “이번엔 진짜 새 수가 나온 건가”에 더 꽂혔다. Scientific American이 전한 23세 Liam Price와 GPT-5.4 Pro의 60년 묵은 Erdos 문제 풀이가, novelty와 전문가 정리 작업, 수학자 역할을 둘러싼 토론으로 번졌다.
HN은 이번 수학 이야기를 "AI가 또 해냈다"보다 사람이 못 본 길을 찍어준 사건으로 봤다. 거친 GPT-5.4 Pro 초안을 수학자들이 추려내고 다듬는 과정 자체가 더 큰 화제가 됐다.
닫힌 benchmark 대신 live math frontier가 움직였다는 점에서 무게가 다르다. Together는 EinsteinArena agents가 11차원 kissing number 하한을 593에서 604로 끌어올렸고, 4월 11일 기준 open problem에서 11개의 새로운 SOTA를 기록했다고 적었다.
Google DeepMind는 February 11, 2026 Gemini Deep Think가 수학·물리·computer science 전문 연구 문제를 푸는 단계로 확장됐다고 발표했다. 회사는 수학 연구 agent인 Aletheia, up to 90%의 IMO-ProofBench Advanced 성과, 18개 연구 문제 협업 사례를 통해 AI가 과학 연구의 보조 수단을 넘어 협업 도구로 이동하고 있다고 설명했다.
Epoch AI가 GPT-5.4 Pro를 활용한 FrontierMath Open Problems 조합론 과제 해법을 확인했다고 밝히면서, HN의 초점이 단순 benchmark score보다 expert-verified research workflow로 옮겨갔다.
OpenAI는 2026년 2월 20일 First Proof의 연구급 수학 문제 10개 전부에 대한 proof attempt를 공개했다고 밝혔다. 회사는 외부 expert feedback 이후 최소 5개 시도가 정답일 가능성이 높다고 보고 있지만, 일부는 아직 검토 중이며 problem 2 시도는 잘못됐다고 판단했다.
r/singularity의 고득점 글은 Donald Knuth의 노트 <em>Claude’s Cycles</em>를 가리키며, Claude Opus 4.6이 TAOCP 작업 중 나온 조합론 문제를 푸는 데 기여했다고 적은 사례를 재조명했다.
Google DeepMind의 AI 수학 연구 에이전트 Aletheia가 FirstProof Challenge에서 전문가 심사단이 인정한 연구 수준 수학 문제 10개 중 6개를 자율적으로 해결했습니다. Gemini Deep Think 기반의 이 에이전트는 테렌스 타오 등 수학자들로부터 가치 있는 연구 협력자로 인정받고 있습니다.
Hacker News에서 주목받은 arXiv 논문 2602.10177은 Aletheia라는 수학 연구 에이전트를 소개한다. 저자들은 IMO 수준 추론에서 출발해 PhD 수준 문제와 공개 난제 탐색까지 확장된 워크플로를 제시했다.