전체기사 최신뉴스 GAM
KYD 디데이
글로벌·중국 미국·북미

속보

더보기

GPT-4, 美 의사시험 '90점 이상' 합격...선천성 희귀병도 맞춰

기사입력 :

최종수정 :

※ 본문 글자 크기 조정

  • 더 작게
  • 작게
  • 보통
  • 크게
  • 더 크게

※ 번역할 언어 선택

GPT-4, 평균 60점이었던 이전 모델에서 향상
검진표 보고 발병 10만분의 1 선천성 희귀병도 맞춰
"내가 여태 봐온 많은 의사들 보다도 낫다"

[서울=뉴스핌] 최원진 기자= 대화형 인공지능(AI) 챗GPT의 유료 서비스인 챗GPT플러스(+)에서 지난달부터 서비스하고 있는 최신 거대언어모델(LLM) 'GPT-4'에 미국 의사면허시험(USMLE) 문제를 출제했더니 높은 점수로 '합격'했다는 결과가 나왔다.

미 경제전문 매체 인사이더가 오는 13일(현지시간) 출판될 '의료계의 AI 혁명: GPT-4와 그 너머'(The AI Revolution in Medicine: GPT-4 and Beyond) 신간을 입수해 6일 보도한 바에 따르면 현직 의사이자 하버드대학교에서 컴퓨터를 활용해 생물학을 연구하는 생물정보학 교수인 아이잭 코핸 박사는 두 명의 동료 연구원들과 GPT-4의 의학 지능 탐구에 나섰다.

코핸 박사와 연구진이 GPT-4에 미 의사면허시험 출제 문제들을 물어보니 무려 90% 이상의 정답률을 보여 '합격'했다.

진료실 책상에 놓인 청진기. 사진은 본 기사 내용과 무관하다. [사진=블룸버그]

이는 지난 2월 이전 LLM 버전인 GPT-3와 GPT-3.5를 대상으로 진행한 연구 결과 때보다 월등히 향상된 점수다. 지난 2월 9일 미국공공과학도서관(PLOS)에서 발행하는 학술전문지 'PLOS 디지털 헬스'에 실린 미 캘리포니아 의료기관 '앤시블헬스'의 연구에서 GPT-3와 GPT-3.5는 평균 60%에 가까운 정답률을 보였는데 의사면허 취득을 위한 최하 점수는 60%여서 당시의 챗GPT는 매우 근소한 차이로 합격하지 못했다.

GPT-4는 '훌륭한 수험생'일 뿐만 아니라 엄청난 의료전문 번역가라고 연구진은 말한다. 포르투갈 환자를 위한 퇴원 수속 정보 안내부터 복잡하고 어려운 의학용어를 초등 6학년이 이해할 만한 수준으로 해석해 설명해주는 등 일반 의사들도 해내기 어려운 환자 응대를 GPT-4는 훌륭히 해낸다는 설명이다.

GPT-4는 든든한 의사 조수 역할도 한다. 예시로 해당 모델은 입원환자들을 대할 때 적절한 태도를 조언해주는 데, '최대한 명확한 언어로 열정적이고 친절하게' 환자를 응대할 수 있는 말들을 추천해준다. 장문의 의학논문도 '눈 깜짝할 사이에' 요약해주기도 하며 심지어 논문과 각종 보고서에서 발췌한 정보들을 바탕으로 직접 인간지능처럼 분석해낸다.

코핸 박사는 GPT-4가 임상진단 능력도 있는지 시험해봤다. 그가 과거에 실제로 진단했던 신생아 환자 사례를 갖고 GPT-4에 환자의 각종 호르몬 수치와 초음파 등 신체검진 기록을 알려줬더니 발병률이 10만분의 1로 희귀질환인 '선천성 부신 과형성'을 완벽히 진단해냈다.

선천성 부신 과형성은 부신 피질에서 나오는 호르몬의 생합성에 관여하는 효소가 선천적으로 결핍되어 나타나는 질환으로, 희귀병이어서인지 단번에 해당 질환을 짚어내는 의사가 많지 않다고 코핸은 말한다.

그는 "내가 다년간의 공부와 연구, 경험에서 비롯해 진단했던 그대로였다"며 매우 인상깊었다면서도 한편으로는 "소름이 끼쳤다"고 말했다.

이어 코핸은 "내가 이런 말을 하게 될줄은 몰랐다. GPT-4는 내가 여태 봐온 많은 의사들 보다도 낫다"고 발언했다.

그는 "언젠가 수많은 가정에서 이 놀라운 가상 의료전문가를 만날 수 있다는 생각에 한편으로는 불안하다"며 "GPT-4의 의료 권고들이 안전하고 효과적일 것이란 검증과 보장은 어떻게 할지 현재 나로선 모르겠다"고 말했다.

GPT-4 등 언어 모델이 존재하지 않는 정보를 팩트처럼 답하거나 답변에 사실적 오류를 범하는 현상을 인공지능 용어로 '할루시네이션'(hallucination·환각 현상)이라고 일컫는다.

구글이 지난 2월 6일 공개한 챗봇 '바드'의 시연영상에서 역사적 사실에 틀린 답변을 한 것도 할루시네이션의 한 예이다. 챗GPT 개발사인 오픈AI조차 챗봇이 종종 틀린 답변을 할 수 있다며, 아직은 할루시네이션에서 자유로울 수 없다고 밝혔다.

코핸은 실제 의료상황에서 발생할 수 있는 할루시네이션과 관련해 "의사들도 불완전하고 부정확한 데이터를 바탕으로 잘못된 추정을 하거나 실수를 범한다. 나 역시 인간 의사와 간호사들에게 요구하는 임상적 판단과 도덕적 책임 기준은 없다"고 말했다.

wonjc6@newspim.com

 

[뉴스핌 베스트 기사]

사진
국회, 한성숙 청문보고서 채택 [서울=뉴스핌] 송기욱 기자 = 한성숙 국무총리 후보자에 대한 국회 인사청문 심사경과보고서가 30일 더불어민주당 주도로 채택됐다. 국민의힘은 회의에 불참했다. 국회 국무총리 임명동의에 관한 인사청문특별위원회는 이날 오전 제5차 회의를 열고 한 후보자 임명동의안 심사경과보고서 채택의 건을 의결했다. [서울=뉴스핌] 이건주 기자 = 26일 오전 서울 여의도 국회에서 한성숙 국무총리 후보자의 인사청문회가 열리고 있다. 2026.06.26 kunjoo@newspim.com 백혜련 위원장은 "전날까지가 청문보고서 채택 마감일이었다"며 "계속해서 국민의힘 의원님들을 설득하고 함께 합의 채택하기를 요청드렸지만 오늘 이 자리까지도 오시지 않았다"고 말했다. 특위는 보고서 종합의견 일부 문구를 수정한 뒤 한 후보자 임명동의안 심사경과보고서를 채택했다. 보고서에는 한 후보자가 국무총리로서 적합하다는 다수 의견과 함께, 국민의힘이 청문 과정에서 제기한 부적격 의견도 함께 담겼다. 한 후보자 임명동의안은 이날 오후 본회의 표결 절차를 밟을 전망이다. 국무총리 임명동의안은 본회의에서 재적의원 과반 출석과 출석의원 과반 찬성으로 의결된다. 민주당이 과반 의석을 확보하고 있는 만큼 국민의힘이 표결에 불참하거나 반대표를 던지더라도 인준안 처리는 가능한 구조다. oneway@newspim.com 2026-06-30 11:58
사진
골드만삭스 "금 랠리 안 끝났다" [시드니=뉴스핌] 권지언 특파원 = 최근 4개월간 부진했던 금 가격이 올해 랠리의 종료를 의미하는 것은 아니라는 분석이 나왔다. 골드만삭스 원자재 리서치 공동 헤드 사만다 다트는 지난 주말 보고서에서 "금은 아직 끝나지 않았다(Gold is not done)"고 주장했다. 다트와 연구팀은 금이 2022년 이후 123% 상승했다는 점을 짚으면서 "구조적 요인과 향후 경기순환적 요인 모두에 힘입어 추가 상승 여력이 있다고 본다"고 설명했다. 금 선물 가격 1년 추이 [AI 일러스트=권지언 기자] ◆ "2026년 말 온스당 4,900달러"…중앙은행 자산 다변화가 핵심 동력 연초 대비 금 가격은 6% 이상 하락한 상태로, 지난 1월 말 사상 최고치를 기록한 이후 조정이 이어지고 있다. 다트는 "구조적으로는 2022년 러시아 외환보유액 동결 이후 이어지고 있는 신흥국(EM) 중앙은행의 자산 다변화가 2026년 말 금 가격 전망치 4,900달러/온스의 근간"이라고 말했다. 연구팀은 또 세계금협회(World Gold Council) 조사에서 올해 2~5월 사이 조사 대상 중앙은행 76곳 중 45%가 향후 12개월 내 금 보유량을 늘릴 계획이라고 응답했다며, 이는 사상 최고 수준이라고 덧붙였다. ◆ 단기 변수는 매파적 연준…ETF 수요는 점진적 회복 전망 다만 경기순환적 측면에서는 단기 역풍도 존재한다. 매파적인 연준 기조가 통화가치 희석(디베이스먼트) 우려를 잠재우고 있는 데다, 시장이 인플레이션 우려 속에 올해 연준의 금리 인상 가능성을 가격에 반영하면서 금리에 민감한 상장지수펀드(ETF) 수요가 압박받고 있다는 설명이다. 다트는 "이러한 역풍은 시간이 지나며 적어도 부분적으로는 반전될 것으로 본다"고 밝혔다. 연구팀은 ETF 포지션이 점차 늘어날 것으로 예상했는데, 이는 연준이 올해는 금리를 동결하고 인하 사이클은 내년 하반기로 미룰 것이라는 골드만삭스 이코노미스트들의 전망과도 일치한다. 다트는 "중기적으로는 서구권의 재정 건전성 우려를 포함한 거시적 변화가 결국 민간 부문의 금 분산투자를 가속화하면서, 금 가격 전망 리스크는 여전히 상방으로 기울어져 있다"고 강조했다. 귀금속 가격은 지난 2월 말 이란 전쟁 발발 이후 급락세를 보이며 금값은 약 24% 떨어졌다. 유가 상승에 따른 인플레이션 지표 악화로 매도세는 더욱 가팔라졌다. 원유 가격이 일부 후퇴했음에도 불구하고, 끈질긴 인플레이션과 견조한 노동시장이 연준으로 하여금 금리를 더 오래 동결하거나 연내 추가 인상에 나서게 할 수 있다는 우려가 투자자들 사이에서 커지고 있다. kwonjiun@newspim.com 2026-06-30 11:21
기사 번역
결과물 출력을 준비하고 있어요.
종목 추적기

S&P 500 기업 중 기사 내용이 영향을 줄 종목 추적

결과물 출력을 준비하고 있어요.

긍정 영향 종목

  • Lockheed Martin Corp. Industrials
    우크라이나 안보 지원 강화 기대감으로 방산 수요 증가 직접적. 미·러 긴장 완화 불확실성 속에서도 방위산업 매출 안정성 강화 예상됨.

부정 영향 종목

  • Caterpillar Inc. Industrials
    우크라이나 전쟁 장기화 시 건설 및 중장비 수요 불확실성 직접적. 글로벌 인프라 투자 지연으로 매출 성장 둔화 가능성 있음.
이 내용에 포함된 데이터와 의견은 뉴스핌 AI가 분석한 결과입니다. 정보 제공 목적으로만 작성되었으며, 특정 종목 매매를 권유하지 않습니다. 투자 판단 및 결과에 대한 책임은 투자자 본인에게 있습니다. 주식 투자는 원금 손실 가능성이 있으므로, 투자 전 충분한 조사와 전문가 상담을 권장합니다.
안다쇼핑
Top으로 이동