구글 딥마인드, 'AI 공동 임상의' 이니셔티브 공개—98개 쿼리 중 97건 오류 없음
구글 딥마인드가 의사를 지원하는 멀티모달 AI 에이전트 연구 'AI 공동 임상의'를 공개했다. 1차 진료 쿼리 98건 중 97건에서 치명적 오류 없이 의사 수준의 성능을 달성했으며, WHO가 예측하는 의료 인력 1,000만 명 부족 문제에 대한 AI 기반 접근법을 제시했다.
DeepMind AI 공동임상의부터 Harvard·Science 논문까지, AI가 응급실 의사의 진단 정확도를 상회한다는 2026년 연구들을 모았습니다.
구글 딥마인드가 의사를 지원하는 멀티모달 AI 에이전트 연구 'AI 공동 임상의'를 공개했다. 1차 진료 쿼리 98건 중 97건에서 치명적 오류 없이 의사 수준의 성능을 달성했으며, WHO가 예측하는 의료 인력 1,000만 명 부족 문제에 대한 AI 기반 접근법을 제시했다.
하버드 의대 임상 시험에서 OpenAI o1이 응급실 환자를 의사보다 높은 정확도로 진단했다. 더 많은 정보가 제공됐을 때 AI 정확도는 82%까지 올랐고, 장기 치료 계획에서도 89% vs 의사 34%로 큰 격차를 보였다.
하버드 의대와 Beth Israel Deaconess가 Science에 게재한 연구에서 OpenAI o1 모델이 실제 응급실 케이스 76건 중 67%를 정확히 진단했다. 두 내과 전문의의 정확도(55%, 50%)를 웃도는 결과다.
저명 학술지 Science에 게재된 새 연구에 따르면 최신 LLM이 실제 응급실 데이터와 수백 명의 의사 비교 실험에서 진단, 응급 분류, 다음 처치 결정 등 임상 과제 전반에서 인간 의사와 동등하거나 상회하는 성과를 보였다. 연구자들은 AI가 의사를 대체하는 것이 아니라 협력적 돌봄 모델로 통합돼야 한다고 강조했다.
이번 결과의 핵심은 의사 대체가 아니라 보조 정확도다. Google DeepMind는 AI 공동임상이 현실적인 1차진료 질의 98건 중 97건에서 중대 오류 없이 답했고, 멀티모달 원격진료 시뮬레이션에서는 의사가 여전히 전체적으로 앞섰다고 밝혔다.