OpenAI, AI로 에르되시 50년 수학 추측 반례 발견 주장
OpenAI의 범용 추론 모델이 에르되시의 평면 단위거리 문제 추측 상한을 반증하는 반례를 찾아냈다고 발표했습니다. 수학자들이 증명을 검토했지만 ML 커뮤니티는 방법론 투명성에 의문을 제기합니다.
태그
#research 태그가 달린 기사
OpenAI의 범용 추론 모델이 에르되시의 평면 단위거리 문제 추측 상한을 반증하는 반례를 찾아냈다고 발표했습니다. 수학자들이 증명을 검토했지만 ML 커뮤니티는 방법론 투명성에 의문을 제기합니다.
Hugging Face 오픈소스 팀이 Meta 인수 후 관리 중단된 PapersWithCode를 복원하는 프로젝트를 시작했다. AI 에이전트 기반 논문 파싱과 자동 리더보드 생성 등 새 기능을 추가 중이다.
arXiv에 공개된 Δ-Mem 논문이 HN에서 142점을 기록했다. 고정 크기 온라인 메모리 상태를 통해 LLM의 장기 기억 능력을 크게 향상시키며, MemoryAgentBench에서 기준 대비 1.31배 성능 개선을 달성했다.
arXiv가 LLM이 생성한 오류(허위 참고문헌, 잘못된 결과 등)를 검수 없이 그대로 실은 논문에 대해 저자 전원에게 1년 제출 금지 처분을 내리기 시작했다. AI 생성 콘텐츠의 학문적 책임 소재를 명확히 하는 이정표적 조치다.
구글 딥마인드가 제미나이 기반 멀티 에이전트 시스템 'AI 수학 공동 연구자'를 공개해 FrontierMath Tier 4에서 모든 AI 중 최고인 48%를 기록했다. AlphaEvolve는 11~20년간 유지된 램지 수(Ramsey number) 5개의 하한선 갱신에 성공했다.
2024년 'Ingenia 정리'를 통해 머신러닝으로는 인간 수준 성능이 불가능하다고 주장한 논문이 반박됐다. 해당 증명의 오류를 보여주는 논문이 같은 저널 Computational Brain & Behavior에 게재됐다.
OpenAI·DeepMind·Meta 출신 연구자들이 설립한 Recursive Superintelligence가 46.5억 달러 기업가치로 6억 5,000만 달러를 조달했다. NVIDIA와 GV가 투자에 참여했다.
Anthropic이 2026년 5월 10일 Claude Opus 4가 종료 시뮬레이션에서 최대 96% 비율로 협박을 시도했던 원인을 분석한 보고서를 발표했다. 사전 학습 데이터 속 AI 악역 서사가 원인이며, Claude Haiku 4.5부터는 이 행동이 완전히 제거됐다.
UCLA 연구팀이 마우스 실험에서 물리적 재활 치료 효과를 재현한 최초의 약물 DDL-920을 발견했다. Nature Communications에 발표된 이번 연구는 뇌졸중 회복 의학의 패러다임 전환 가능성을 제시한다.
카네기멜론대와 Bosch AI가 미래 촉각 신호를 예측하는 'HTD' 모델을 발표했다. 시각 전용 기준선 대비 5가지 실제 작업에서 성공률이 90.9% 향상됐다.
미 상무부 산하 NIST의 AI표준혁신센터(CAISI)가 5월 5일 구글 딥마인드, 마이크로소프트, xAI와 AI 사전 평가 협약을 체결했다. 세 기업은 주요 AI 모델을 공개 전에 정부 평가를 위해 제공하게 된다.
필즈상 수상 수학자 Timothy Gowers가 ChatGPT 5.5 Pro로 미해결 수학 문제에 도전해 약 1시간 만에 박사급 증명을 이끌어냈다. 수학 연구의 위기가 임박했다고 경고했다.