하버드 연구: OpenAI o1, 응급실 환자 67% 정확 진단
하버드 의대 임상 시험에서 OpenAI o1이 응급실 환자를 의사보다 높은 정확도로 진단했다. 더 많은 정보가 제공됐을 때 AI 정확도는 82%까지 올랐고, 장기 치료 계획에서도 89% vs 의사 34%로 큰 격차를 보였다.
원문: OpenAI's o1 correctly diagnosed 67% of ER patients vs. 50-55% by triage doctors 원문 보기 →
하버드 의대 임상 시험
하버드 의대 연구팀이 보스턴 응급실에서 76명의 환자를 대상으로 OpenAI의 o1 추론 모델과 의사 팀의 진단 능력을 비교하는 시험을 진행했다. 양쪽 모두 동일한 전자 건강 기록(바이탈 사인, 인구통계 정보, 간호사 트리아지 메모)을 받았다.
핵심 수치
- 기본 트리아지 정보: AI 67% vs 의사 50~55%
- 상세 정보 제공 시: AI 82% vs 의사 70~79%
- 장기 치료 계획(5개 임상 케이스): AI 89% vs 의사 34%
AI의 강점은 정보가 제한된 긴급 판단 상황에서 특히 두드러졌다. 한 케이스에서는 혈전 환자에게 항응고제가 효과 없다고 판단한 의사들과 달리, AI는 루푸스 병력을 포착해 실제 원인이 폐 염증임을 정확히 짚어냈다.
의사 대체가 아닌 협력 모델
연구 주저자인 Arjun Manrai 하버드 의대 교수는 "이 결과가 AI가 의사를 대체한다는 의미는 아니다"라고 밝혔다. 이번 연구는 텍스트 데이터만을 대상으로 했으며, 환자의 외형이나 고통 수준은 평가하지 않았다. 즉 AI는 서류 기반 세컨드 오피니언 역할에 가까웠다.
공동 저자 Adam Rodman 박사는 LLM을 "수십 년 만에 가장 영향력 있는 기술" 중 하나로 꼽으며, 앞으로 10년 내 의료가 의사·환자·AI의 삼자 케어 모델로 재편될 것으로 전망했다.
이미 진행 중인 도입
미국 의사의 약 20%가 이미 AI를 진단 보조에 활용 중이며, 영국에서는 의사의 16%가 매일, 15%가 매주 AI를 사용하고 있다. 현장에서의 최대 우려는 AI 오류와 법적 책임이다.
관련 기사
OpenAI 최대 신기능 출시 연기, 다음 주로
Sam Altman이 9월 16일 이번 주 가장 기대했던 출시를 다음 주로 미룬다고 밝혔다. GPT-6 Sol 등 신모델이 유력한 후보로 거론되며, DevDay 2026 직전 주에 공개될 전망이다.
OpenAI, DevDay 2026 주간 'DevDay 2025급' 연속 출시 예고
Sam Altman OpenAI CEO가 9월 15일 선박 이모지 여섯 개와 함께 이번 주 대형 출시를 예고했다. DevDay 2025 수준의 릴리스가 이번 주 내내 이어지고, 9월 29일 DevDay 2026에서 추가 공개가 예정됐다.
OpenAI 금융 특화 ChatGPT: GPT-6 Astra에 PitchBook·LSEG 데이터를 탑재
OpenAI가 GPT-6 Astra의 추론 능력에 Daloopa, PitchBook, LSEG News, Crunchbase 등 프리미엄 금융 데이터를 내장한 금융 서비스 전용 ChatGPT를 출시했다. 투자은행과 리서치 팀이 리서치 작성부터 재무 모델링, 고객 자료 제작까지 GPT-6 Astra의 추론을 금융 컨텍스트에서 바로 활용할 수 있다.