하버드 연구: OpenAI o1이 응급실 의사보다 높은 진단 정확도—Science 논문
연구 개요
하버드 의대와 Beth Israel Deaconess Medical Center 연구팀이 Science에 게재한 논문에서 OpenAI o1 모델이 실제 응급실 케이스 진단에서 두 내과 전문의를 능가하는 정확도를 기록했다.
핵심 수치
- 실제 응급실 트리아지 케이스 76건 평가
- OpenAI o1: 정확 또는 근접 진단 67%
- 내과 전문의 2명: 각각 55%, 50%
- 5개 심층 임상 케이스: o1 89% vs 기존 검색 도구 활용 의사 46명 34%
연구 조건
모델과 의사 모두 동일한 전처리 없는 전자건강기록(EHR) 데이터를 텍스트 형태로만 받았다. 별도 이미지나 추가 검사 데이터는 제공하지 않아 실제 임상 환경에 근접한 조건을 구현했다.
의미와 한계
연구팀은 AI가 의사를 대체하는 것이 목적이 아니라 진단 보조 도구로서의 가능성을 확인한 것이라고 강조했다. 76건이라는 샘플 크기는 임상 도입 결정에 충분하지 않으며, 희귀 질환과 복잡한 공존 질환에 대한 추가 연구가 필요하다.
출처: TechCrunch
Related Articles
OpenAI가 미공개 모델 Astra로 수학·이론컴퓨터과학의 장기 미해결 문제 10건에 대한 새 결과를 냈다. 각 논증은 사람이 논문 형태로 정리한 뒤 Lean certificate로 형식 검증됐고, 탐색 비용은 Sol API 요금 기준 약 $2,000로 제시됐다.
OpenAI의 차기 모델 계열 Astra가 수학·이론컴퓨터과학의 장기 미해결 문제 10개에서 새 결과를 냈다. OpenAI는 전체 해법 탐색의 토큰 비용을 Sol API 기준 약 $2,000로 제시했고, 각 결과를 Lean 증명서와 함께 공개했다.
Cambridge·UCL 연구팀이 개발한 생성형 AI 시스템 CytoDiffusion이 50만 장의 혈액 도말 이미지로 학습해 백혈병 관련 이상 세포를 인간보다 높은 정확도로 식별했다.