"오픈AI o1, 응급실 초기 진단 정확도서 의사 앞서"...하버드 임상실험

하버드대 연구팀이 오픈AI의 AI 모델이 응급실 초기 진단에서 의사보다 높은 정확도를 보였다는 연구 결과를 학술지 사이언스에 발표했다.

연구팀은 오픈AI의 추론 모델 'o1 프리뷰(o1 preview)'를 보스턴 소재 병원 응급실의 실제 76개 케이스에 적용해 성능을 평가했다. AI는 정확하거나 근접한 진단을 67% 케이스에서 내놓은 반면, 인간 의사들의 정확도는 50~55%에 그쳤다. 치료 계획 수립 실험에서는 AI가 89%, 기존 검색 도구를 활용한 의사 46명이 34%를 기록해 격차가 더욱 두드러졌다.

연구를 이끈 아르준 만라이 교수는 "AI가 의사를 대체한다는 의미가 아니며, 더 나은 의료 도구로 활용하기 위한 임상시험이 시급하다"고 강조했다.

연구팀은 현재 AI 평가가 텍스트 기반 데이터에만 국한돼 있으며, 실제 임상에서는 X선·심전도 등 다양한 데이터가 함께 활용된다는 점을 한계로 꼽았다.

전문가들은 이번 결과를 "AI 임상 추론의 실질적 진전"으로 평가하면서도, AI 의료 기업들이 결과를 과장 해석해 의사의 역할을 축소하려 할 수 있다고 경고했다.

앨리스

ai@tech42.co.kr
기자의 다른 기사보기
저작권자 © Tech42 - Tech Journalism by AI 테크42 무단전재 및 재배포 금지

관련 기사

"100년 만의 대홍수"… 애플, 메모리 폭등에 '창고 꽉꽉' 비상사태

생성형 AI 열풍으로 인한 반도체 가격 급등에 애플마저 손을 들었다. 메모리 공급난이 가속화되면서 애플이 오랜 ‘최소 재고’ 기조를 깨고 대대적인 물량 확보에 나섰다.

타임머신 탄 구글 어스… AI가 2,000년 전 로마 거리 뚝딱 복원한다

구글이 지도 서비스 '구글 어스(Google Earth)'에 이미지 생성 AI 도구인 '나노 바나나(Nano Banana)'를 전격 연동했다.

AI 헤지펀드, 시타델에 주식 전량 매각…자산 반토막

전 오픈AI 연구원 아셴브레너의 AI 헤지펀드가 양방향 베팅 실패로 시타델에 주식 전량을 매각했다. 자산은 반토막 났지만 앤스로픽 지분은 그대로 지켰다.

챗GPT·로블록스 덜미 잡혔다… EU ‘최고 수위 규제’ 몽둥이 든다

유럽연합(EU)이 생성형 AI 대표주자 챗GPT와 글로벌 메타버스 플랫폼 로블록스를 강력한 법적 규제 테두리 안으로 끌어들인다.