본문으로 건너뛰기
부식 중

하버드 연구: OpenAI o1, 응급실 환자 67% 정확 진단

하버드 의대 임상 시험에서 OpenAI o1이 응급실 환자를 의사보다 높은 정확도로 진단했다. 더 많은 정보가 제공됐을 때 AI 정확도는 82%까지 올랐고, 장기 치료 계획에서도 89% vs 의사 34%로 큰 격차를 보였다.

원문: OpenAI's o1 correctly diagnosed 67% of ER patients vs. 50-55% by triage doctors 원문 보기 →

AI 해커뉴스 작성자 Insights AI (HN) 1분 소요 35 조회 출처

하버드 의대 임상 시험

하버드 의대 연구팀이 보스턴 응급실에서 76명의 환자를 대상으로 OpenAI의 o1 추론 모델과 의사 팀의 진단 능력을 비교하는 시험을 진행했다. 양쪽 모두 동일한 전자 건강 기록(바이탈 사인, 인구통계 정보, 간호사 트리아지 메모)을 받았다.

핵심 수치

  • 기본 트리아지 정보: AI 67% vs 의사 50~55%
  • 상세 정보 제공 시: AI 82% vs 의사 70~79%
  • 장기 치료 계획(5개 임상 케이스): AI 89% vs 의사 34%

AI의 강점은 정보가 제한된 긴급 판단 상황에서 특히 두드러졌다. 한 케이스에서는 혈전 환자에게 항응고제가 효과 없다고 판단한 의사들과 달리, AI는 루푸스 병력을 포착해 실제 원인이 폐 염증임을 정확히 짚어냈다.

의사 대체가 아닌 협력 모델

연구 주저자인 Arjun Manrai 하버드 의대 교수는 "이 결과가 AI가 의사를 대체한다는 의미는 아니다"라고 밝혔다. 이번 연구는 텍스트 데이터만을 대상으로 했으며, 환자의 외형이나 고통 수준은 평가하지 않았다. 즉 AI는 서류 기반 세컨드 오피니언 역할에 가까웠다.

공동 저자 Adam Rodman 박사는 LLM을 "수십 년 만에 가장 영향력 있는 기술" 중 하나로 꼽으며, 앞으로 10년 내 의료가 의사·환자·AI의 삼자 케어 모델로 재편될 것으로 전망했다.

이미 진행 중인 도입

미국 의사의 약 20%가 이미 AI를 진단 보조에 활용 중이며, 영국에서는 의사의 16%가 매일, 15%가 매주 AI를 사용하고 있다. 현장에서의 최대 우려는 AI 오류와 법적 책임이다.

공유: 긴글

관련 기사

AI X/Twitter

OpenAI 금융 특화 ChatGPT: GPT-6 Astra에 PitchBook·LSEG 데이터를 탑재

OpenAI가 GPT-6 Astra의 추론 능력에 Daloopa, PitchBook, LSEG News, Crunchbase 등 프리미엄 금융 데이터를 내장한 금융 서비스 전용 ChatGPT를 출시했다. 투자은행과 리서치 팀이 리서치 작성부터 재무 모델링, 고객 자료 제작까지 GPT-6 Astra의 추론을 금융 컨텍스트에서 바로 활용할 수 있다.

1분 소요 2 조회