전체기사 최신뉴스 GAM 라씨로
KYD 디데이
글로벌 미국·북미

속보

더보기

GPT-4, 美 의사시험 '90점 이상' 합격...선천성 희귀병도 맞춰

기사입력 : 2023년04월07일 09:53

최종수정 : 2023년04월07일 09:53

GPT-4, 평균 60점이었던 이전 모델에서 향상
검진표 보고 발병 10만분의 1 선천성 희귀병도 맞춰
"내가 여태 봐온 많은 의사들 보다도 낫다"

[서울=뉴스핌] 최원진 기자= 대화형 인공지능(AI) 챗GPT의 유료 서비스인 챗GPT플러스(+)에서 지난달부터 서비스하고 있는 최신 거대언어모델(LLM) 'GPT-4'에 미국 의사면허시험(USMLE) 문제를 출제했더니 높은 점수로 '합격'했다는 결과가 나왔다.

미 경제전문 매체 인사이더가 오는 13일(현지시간) 출판될 '의료계의 AI 혁명: GPT-4와 그 너머'(The AI Revolution in Medicine: GPT-4 and Beyond) 신간을 입수해 6일 보도한 바에 따르면 현직 의사이자 하버드대학교에서 컴퓨터를 활용해 생물학을 연구하는 생물정보학 교수인 아이잭 코핸 박사는 두 명의 동료 연구원들과 GPT-4의 의학 지능 탐구에 나섰다.

코핸 박사와 연구진이 GPT-4에 미 의사면허시험 출제 문제들을 물어보니 무려 90% 이상의 정답률을 보여 '합격'했다.

진료실 책상에 놓인 청진기. 사진은 본 기사 내용과 무관하다. [사진=블룸버그]

이는 지난 2월 이전 LLM 버전인 GPT-3와 GPT-3.5를 대상으로 진행한 연구 결과 때보다 월등히 향상된 점수다. 지난 2월 9일 미국공공과학도서관(PLOS)에서 발행하는 학술전문지 'PLOS 디지털 헬스'에 실린 미 캘리포니아 의료기관 '앤시블헬스'의 연구에서 GPT-3와 GPT-3.5는 평균 60%에 가까운 정답률을 보였는데 의사면허 취득을 위한 최하 점수는 60%여서 당시의 챗GPT는 매우 근소한 차이로 합격하지 못했다.

GPT-4는 '훌륭한 수험생'일 뿐만 아니라 엄청난 의료전문 번역가라고 연구진은 말한다. 포르투갈 환자를 위한 퇴원 수속 정보 안내부터 복잡하고 어려운 의학용어를 초등 6학년이 이해할 만한 수준으로 해석해 설명해주는 등 일반 의사들도 해내기 어려운 환자 응대를 GPT-4는 훌륭히 해낸다는 설명이다.

GPT-4는 든든한 의사 조수 역할도 한다. 예시로 해당 모델은 입원환자들을 대할 때 적절한 태도를 조언해주는 데, '최대한 명확한 언어로 열정적이고 친절하게' 환자를 응대할 수 있는 말들을 추천해준다. 장문의 의학논문도 '눈 깜짝할 사이에' 요약해주기도 하며 심지어 논문과 각종 보고서에서 발췌한 정보들을 바탕으로 직접 인간지능처럼 분석해낸다.

코핸 박사는 GPT-4가 임상진단 능력도 있는지 시험해봤다. 그가 과거에 실제로 진단했던 신생아 환자 사례를 갖고 GPT-4에 환자의 각종 호르몬 수치와 초음파 등 신체검진 기록을 알려줬더니 발병률이 10만분의 1로 희귀질환인 '선천성 부신 과형성'을 완벽히 진단해냈다.

선천성 부신 과형성은 부신 피질에서 나오는 호르몬의 생합성에 관여하는 효소가 선천적으로 결핍되어 나타나는 질환으로, 희귀병이어서인지 단번에 해당 질환을 짚어내는 의사가 많지 않다고 코핸은 말한다.

그는 "내가 다년간의 공부와 연구, 경험에서 비롯해 진단했던 그대로였다"며 매우 인상깊었다면서도 한편으로는 "소름이 끼쳤다"고 말했다.

이어 코핸은 "내가 이런 말을 하게 될줄은 몰랐다. GPT-4는 내가 여태 봐온 많은 의사들 보다도 낫다"고 발언했다.

그는 "언젠가 수많은 가정에서 이 놀라운 가상 의료전문가를 만날 수 있다는 생각에 한편으로는 불안하다"며 "GPT-4의 의료 권고들이 안전하고 효과적일 것이란 검증과 보장은 어떻게 할지 현재 나로선 모르겠다"고 말했다.

GPT-4 등 언어 모델이 존재하지 않는 정보를 팩트처럼 답하거나 답변에 사실적 오류를 범하는 현상을 인공지능 용어로 '할루시네이션'(hallucination·환각 현상)이라고 일컫는다.

구글이 지난 2월 6일 공개한 챗봇 '바드'의 시연영상에서 역사적 사실에 틀린 답변을 한 것도 할루시네이션의 한 예이다. 챗GPT 개발사인 오픈AI조차 챗봇이 종종 틀린 답변을 할 수 있다며, 아직은 할루시네이션에서 자유로울 수 없다고 밝혔다.

코핸은 실제 의료상황에서 발생할 수 있는 할루시네이션과 관련해 "의사들도 불완전하고 부정확한 데이터를 바탕으로 잘못된 추정을 하거나 실수를 범한다. 나 역시 인간 의사와 간호사들에게 요구하는 임상적 판단과 도덕적 책임 기준은 없다"고 말했다.

wonjc6@newspim.com

 

[뉴스핌 베스트 기사]

사진
尹대통령 국정 지지율 30.1%…부정평가 66.7% '경고등' [서울=뉴스핌] 김종원 전문기자 = 윤석열 대통령의 국정 지지율이 30.1%가 나왔다. 지난 2주 전 뉴스핌 정기 여론조사 38.1%보다 8%포인트가 빠졌다. 반면 부정 지지율은 66.7%로 2주 전 59.3%보다 7.4%포인트가 오른 70%에 육박했다. 정부·여당의 4·10 22대 총선 참패에 따른 국정 심판 여파가 아직도 전 연령과 전국에 부정적 영향을 미치는 것으로 보인다. 국민 10명 중 7명 가까이 윤 대통령의 국정 운영에 대해 부정적 여론이 거센 상황에서 취임 2년을 맞는 윤 대통령의 국정 동력 확보에 경고등이 켜졌다. 이번 정례 여론조사는 뉴스핌 의뢰로 미디어리서치가 지난 4월 29일부터 30일까지 이틀 간 전국 만 18살 이상 남녀 1006명을 대상으로 실시했다.   4·10 총선 민의에 따른 윤 대통령과 제1야당 더불어민주당 이재명 대표 간의 지난 29일 첫 영수회담 결과는 아직 민심에 온전히 반영되지 않아 좀 더 여론의 추이를 봐야 할 것으로 보인다. 이번 정례 조사에서 '매우 잘하고 있다' 15.2%, '잘하고 있는 편' 14.9%로 국정 긍정 평가는 30.1%였다. 4·10 총선 직후 2주 전인 지난 4월 15·16일 뉴스핌 정기조사 때 긍정평가 38.1%보다 8%포인트 하락했다. 윤 대통령의 국정 운영에 대한 긍정 지지율이 뉴스핌 정기 여론조사에서 30%선이 무너질 위기에 처했다. 사실상 국정 장악과 국정 운영 동력 확보에 빨간불이 들어왔다. 부정평가는 '매우 잘 못하고 있다' 57.2%, '잘 못하는 편' 9.5%로 국민 10명 중 7명에 가까운 66.7%였다. 지난 2주 전 조사 59.3%보다 7.4%포인트가 많아졌다. 윤 대통령의 국정 운영에 대한 긍·부정 격차는 지난 2주 전 조사와 비교해서 21.2%포인트에서 36.6%포인트로 크게 벌어졌다. 연령대별로 보면 30대에서 부정평가가 79.2%로 가장 높았다. 40대 77.4%, 50대 70.4%로 30·40·50세대 10명 7명이 윤 대통령 국정 운영에 대해 부정적이었다. 70대 이상에서만 부정 41.0%, 긍정 48.0%로 긍정 평가가 조금 앞섰다. 지역별로는 정부와 여당인 국민의힘의 전통 지지층인 대구경북(TK)에서도 긍정 40.9%, 부정 54.4%로 부정 수치가 10%포인트를 훌쩍 넘어섰다. 부산울산경남(PK)에서는 긍정 35.5%, 부정 61.6%로 긍·부정 격차가 절반 가까이 됐다. 광주전남전북 호남에서는 부정 80.9%, 긍정 16.5%로 10명 중 8명이 부정적이었다. 정당별 지지층에서도 지지층이 없는 무당층의 69.1%가 부정, 긍정 27.9%로 10명 중 7명 가까이가 부정적 평가였다. 김대은 미디어리서치 대표는 윤 대통령의 국정 지지율이 크게 떨어진 이유에 대해 "지난달 29일 이재명 야당 대표와 취임 후 700여 일 만에 첫 영수회담을 했지만 국론 분열과 민생 위기를 타개할 뚜렷한 해법은 없었다"고 분석했다. 김 대표는 "오히려 4·10 총선 참패 이후 단행한 대통령실 비서실장에 찐윤' 인사를 임명하는 등 윤 대통령의 변하지 않는 일방적·독선적 국정운영 스타일과 함께 답이 보이지 않는 의대 증원 문제에 대한 국민 피로감이 커졌다"고 진단했다. 그러면서 김 대표는 "물가 상승으로 인한 민생 경제 불안감 등 여론이 악화되면서 지지층 마저 대거 이탈하며 대통령의 국정 지지율이 추락했다"고 분석했다. 이번 조사는 무선(100%) 가상번호 임의걸기(RDD) 자동응답(ARS) 방식으로 진행됐다. 신뢰 수준은 95%에 표본 오차 ±3.1%포인트, 응답률은 2.9%다. 자세한 조사 내용은 미디어리서치 홈페이지와 중앙선거여론조사심의위원회 홈페이지를 참조하면 된다. kjw8619@newspim.com 2024-05-02 06:00
사진
박찬대 "22대 첫 법안은 25만원 지원금"…최상목 "타깃 지원 효과적" [서울=뉴스핌] 한태희 기자 = 더불어민주당(민주당)이 22대 국회가 열리면 가장 먼저 발의할 법안으로 국민 1명당 25만원을 주는 법안을 꼽은 가운데 정부는 타깃 지원이 효과적이라는 입장을 고수했다. 박찬대 민주당 신임 원내대표는 6일 MBC 라디오 프로그램 '김종배의 시선집중'에 출연해 22대 국회가 개원하면 가장 먼저 발의할 법안에 대한 질문을 받자 "1인당 25만원의 민생회복지원금을 지급하는 법을 낼 수 있을 것"이라고 말했다. 앞서 민주당은 4.10 총선 공약으로 국민 1인당 25만원을 지급하는 민생회복지원금을 제시했다. 소요 재원은 약 13조원으로 추계된다. 박 원내대표는 지난 2일 원내대표 경선 정견 발표에서 민생회복지원금을 위한 추가경정예산(추경) 확보를 위해 여당과 협상을 시작하겠다고 예고했다. 정부는 전국민에게 민생회복지원금을 주는 방안에 난색을 표하고 있다. 정부는 어려움을 겪는 서민층을 대상으로 타깃 지원해야 한다는 입장을 유지하고 있다. 나라 곳간을 책임지는 최상목 부총리 겸 기획재정부 장관은 지난 4일(현지시간) 오후 아시아개발은행(ADB) 연차총회 참석차 조지아 트빌리시를 방문 중에 한국 기자단과 만나 "우리 경제 여건이나 재정 지속가능성을 볼 때 전 국민에게 현금을 준다거나 추경보다는 조금 더 특정해서 사회적 약자나 민생 어려움을 타깃해서 지원하는 게 효과적이지 않나 생각한다"고 말했다. 한편 22대 국회 임기는 오는 5월30일 시작된다. 국회 본회의장 [사진=뉴스핌DB]   ace@newspim.com 2024-05-06 16:09
안다쇼핑
Top으로 이동