하버드 연구: OpenAI o1이 응급실 의사보다 높은 진단 정확도—Science 논문
하버드 의대와 Beth Israel Deaconess가 Science에 게재한 연구에서 OpenAI o1 모델이 실제 응급실 케이스 76건 중 67%를 정확히 진단했다. 두 내과 전문의의 정확도(55%, 50%)를 웃도는 결과다.
연구 개요
하버드 의대와 Beth Israel Deaconess Medical Center 연구팀이 Science에 게재한 논문에서 OpenAI o1 모델이 실제 응급실 케이스 진단에서 두 내과 전문의를 능가하는 정확도를 기록했다.
핵심 수치
- 실제 응급실 트리아지 케이스 76건 평가
- OpenAI o1: 정확 또는 근접 진단 67%
- 내과 전문의 2명: 각각 55%, 50%
- 5개 심층 임상 케이스: o1 89% vs 기존 검색 도구 활용 의사 46명 34%
연구 조건
모델과 의사 모두 동일한 전처리 없는 전자건강기록(EHR) 데이터를 텍스트 형태로만 받았다. 별도 이미지나 추가 검사 데이터는 제공하지 않아 실제 임상 환경에 근접한 조건을 구현했다.
의미와 한계
연구팀은 AI가 의사를 대체하는 것이 목적이 아니라 진단 보조 도구로서의 가능성을 확인한 것이라고 강조했다. 76건이라는 샘플 크기는 임상 도입 결정에 충분하지 않으며, 희귀 질환과 복잡한 공존 질환에 대한 추가 연구가 필요하다.
출처: TechCrunch
관련 기사
AI가 난제를 풀면 수학은 전진할까, Reddit이 갈린 지점
172표가 모인 토론은 AI의 수학 성과를 둘러싼 갈등이 단순한 찬반이 아님을 보여줬다. 한쪽은 인간 연구자의 공로와 검증 절차를 묻고, 다른 쪽은 실제 문제 해결을 인정하지 않는 ‘기준 이동’이라고 맞섰다.
CytoDiffusion: 백혈병 감지에서 인간 전문가를 넘어선 AI 혈액 분석 시스템
Cambridge·UCL 연구팀이 개발한 생성형 AI 시스템 CytoDiffusion이 50만 장의 혈액 도말 이미지로 학습해 백혈병 관련 이상 세포를 인간보다 높은 정확도로 식별했다.
University of Michigan, 뇌 MRI를 수초 만에 분석하는 AI 시스템 개발
미시간 대학 연구진이 뇌 MRI 스캔을 수초 내에 해석하고 응급 사례를 정확히 식별하는 AI 개발. 신경과 진단 속도 혁신.