전체기사 최신뉴스 GAM
KYD 라이브
KYD 디데이
글로벌 미국·북미

속보

더보기

GPT-4, 美 의사시험 '90점 이상' 합격...선천성 희귀병도 맞춰

기사입력 : 2023년04월07일 09:53

최종수정 : 2023년04월07일 09:53

GPT-4, 평균 60점이었던 이전 모델에서 향상
검진표 보고 발병 10만분의 1 선천성 희귀병도 맞춰
"내가 여태 봐온 많은 의사들 보다도 낫다"

[서울=뉴스핌] 최원진 기자= 대화형 인공지능(AI) 챗GPT의 유료 서비스인 챗GPT플러스(+)에서 지난달부터 서비스하고 있는 최신 거대언어모델(LLM) 'GPT-4'에 미국 의사면허시험(USMLE) 문제를 출제했더니 높은 점수로 '합격'했다는 결과가 나왔다.

미 경제전문 매체 인사이더가 오는 13일(현지시간) 출판될 '의료계의 AI 혁명: GPT-4와 그 너머'(The AI Revolution in Medicine: GPT-4 and Beyond) 신간을 입수해 6일 보도한 바에 따르면 현직 의사이자 하버드대학교에서 컴퓨터를 활용해 생물학을 연구하는 생물정보학 교수인 아이잭 코핸 박사는 두 명의 동료 연구원들과 GPT-4의 의학 지능 탐구에 나섰다.

코핸 박사와 연구진이 GPT-4에 미 의사면허시험 출제 문제들을 물어보니 무려 90% 이상의 정답률을 보여 '합격'했다.

진료실 책상에 놓인 청진기. 사진은 본 기사 내용과 무관하다. [사진=블룸버그]

이는 지난 2월 이전 LLM 버전인 GPT-3와 GPT-3.5를 대상으로 진행한 연구 결과 때보다 월등히 향상된 점수다. 지난 2월 9일 미국공공과학도서관(PLOS)에서 발행하는 학술전문지 'PLOS 디지털 헬스'에 실린 미 캘리포니아 의료기관 '앤시블헬스'의 연구에서 GPT-3와 GPT-3.5는 평균 60%에 가까운 정답률을 보였는데 의사면허 취득을 위한 최하 점수는 60%여서 당시의 챗GPT는 매우 근소한 차이로 합격하지 못했다.

GPT-4는 '훌륭한 수험생'일 뿐만 아니라 엄청난 의료전문 번역가라고 연구진은 말한다. 포르투갈 환자를 위한 퇴원 수속 정보 안내부터 복잡하고 어려운 의학용어를 초등 6학년이 이해할 만한 수준으로 해석해 설명해주는 등 일반 의사들도 해내기 어려운 환자 응대를 GPT-4는 훌륭히 해낸다는 설명이다.

GPT-4는 든든한 의사 조수 역할도 한다. 예시로 해당 모델은 입원환자들을 대할 때 적절한 태도를 조언해주는 데, '최대한 명확한 언어로 열정적이고 친절하게' 환자를 응대할 수 있는 말들을 추천해준다. 장문의 의학논문도 '눈 깜짝할 사이에' 요약해주기도 하며 심지어 논문과 각종 보고서에서 발췌한 정보들을 바탕으로 직접 인간지능처럼 분석해낸다.

코핸 박사는 GPT-4가 임상진단 능력도 있는지 시험해봤다. 그가 과거에 실제로 진단했던 신생아 환자 사례를 갖고 GPT-4에 환자의 각종 호르몬 수치와 초음파 등 신체검진 기록을 알려줬더니 발병률이 10만분의 1로 희귀질환인 '선천성 부신 과형성'을 완벽히 진단해냈다.

선천성 부신 과형성은 부신 피질에서 나오는 호르몬의 생합성에 관여하는 효소가 선천적으로 결핍되어 나타나는 질환으로, 희귀병이어서인지 단번에 해당 질환을 짚어내는 의사가 많지 않다고 코핸은 말한다.

그는 "내가 다년간의 공부와 연구, 경험에서 비롯해 진단했던 그대로였다"며 매우 인상깊었다면서도 한편으로는 "소름이 끼쳤다"고 말했다.

이어 코핸은 "내가 이런 말을 하게 될줄은 몰랐다. GPT-4는 내가 여태 봐온 많은 의사들 보다도 낫다"고 발언했다.

그는 "언젠가 수많은 가정에서 이 놀라운 가상 의료전문가를 만날 수 있다는 생각에 한편으로는 불안하다"며 "GPT-4의 의료 권고들이 안전하고 효과적일 것이란 검증과 보장은 어떻게 할지 현재 나로선 모르겠다"고 말했다.

GPT-4 등 언어 모델이 존재하지 않는 정보를 팩트처럼 답하거나 답변에 사실적 오류를 범하는 현상을 인공지능 용어로 '할루시네이션'(hallucination·환각 현상)이라고 일컫는다.

구글이 지난 2월 6일 공개한 챗봇 '바드'의 시연영상에서 역사적 사실에 틀린 답변을 한 것도 할루시네이션의 한 예이다. 챗GPT 개발사인 오픈AI조차 챗봇이 종종 틀린 답변을 할 수 있다며, 아직은 할루시네이션에서 자유로울 수 없다고 밝혔다.

코핸은 실제 의료상황에서 발생할 수 있는 할루시네이션과 관련해 "의사들도 불완전하고 부정확한 데이터를 바탕으로 잘못된 추정을 하거나 실수를 범한다. 나 역시 인간 의사와 간호사들에게 요구하는 임상적 판단과 도덕적 책임 기준은 없다"고 말했다.

wonjc6@newspim.com

 

[뉴스핌 베스트 기사]

사진
폭스콘 "AI 데이터센터, 단계 건설" [서울=뉴스핌] 고인원 기자= 세계 최대 전자 위탁생산업체인 대만 폭스콘이 미국 반도체 기업 엔비디아와 함께 추진 중인 인공지능(AI) 데이터센터 프로젝트가 최대 100메가와트(MW) 규모로 단계적으로 건설될 예정이라고 밝혔다. 류양웨이 폭스콘 회장은 대만 타이베이에서 열린 '2025 컴퓨텍스 타이베이' 기조연설에서 "이번 AI 데이터센터는 엄청난 전력이 필요한 만큼, 단계적으로 구축할 것"이라며 "1차로 20메가와트 규모로 시작한 뒤, 40메가와트를 추가로 설치할 예정이며, 궁극적으로는 100메가와트까지 확대할 계획"이라고 말했다. 이 프로젝트는 전날 엔비디아가 대만을 대표하는 제조 기업 TSMC·폭스콘 및 대만 정부와 함께 초대형 AI 생태계를 대만에 구축한다고 발표한 데 따른 후속 설명이다. 2024년 10월 8일 대만 타이페이에서 열린 폭스콘 연례 기술 전시회에 전시된 폭스콘 전기이륜차 파워트레인 시스템 [서울=뉴스핌]박공식 기자 = 2025.05.14 kongsikpark@newspim.com 류 회장은 "전력은 대만에서 매우 중요한 자원"이라며 "공급 부족이라는 표현은 쓰고 싶지 않지만, 이를 감안해 여러 도시를 대상으로 부지를 분산하는 방식으로 데이터센터를 건설할 것"이라고 설명했다. 일부 시설은 대만 남서부 가오슝시에 우선 들어서며, 나머지는 전력 여건에 따라 다른 도시로 확대될 수 있다고 덧붙였다. 이날 류 회장의 키노트 무대 위로 젠슨 황 엔비디아 CEO가 깜짝 등장해 눈길을 끌었다. 황 CEO는 "이번 AI 센터는 폭스콘, 엔비디아, 그리고 대만 전체 생태계를 위한 시설"이라며 "우리는 대만을 위한 AI 팩토리를 만들고 있다. 여기에는 대만의 350개 파트너사가 참여하고 있다"고 강조했다. 이번 AI 데이터센터는 고성능 컴퓨팅 인프라 확보를 통해 AI 학습 및 추론 속도를 크게 높이고, 대만 내 AI 산업 생태계 전반에 걸쳐 활용될 것으로 기대된다. koinwon@newspim.com 2025-05-20 23:40
사진
[단독] 삼성전자 '엑시노스 부활' 이 기사는 5월 21일 오전 10시04분 프리미엄 뉴스서비스'ANDA'에 먼저 출고됐습니다. 몽골어로 의형제를 뜻하는 'ANDA'는 국내 기업의 글로벌 성장과 도약, 독자 여러분의 성공적인 자산관리 동반자가 되겠다는 뉴스핌의 약속입니다. [서울=뉴스핌] 김아영 기자 = 삼성전자가 올해 하반기와 내년 출시 예정인 갤럭시 플래그십 모델에 자체 모바일 애플리케이션 프로세서(AP) '엑시노스'를 탑재할 계획인 것으로 확인됐다. 오는 7월 공개 예정인 폴더블 신제품에는 '엑시노스 2500·2400', 내년 출시 예정인 갤럭시 S26 시리즈에는 2나노 공정의 '엑시노스 2600'이 적용될 예정이다. 시장과 제품 포지셔닝에 따라 퀄컴 칩셋과 병행 탑재하는 이원화 전략이 병행된다. 삼성전자 엑시노스 [사진=삼성전자] 21일 뉴스핌 취재를 종합하면 삼성전자는 오는 7월 미국 뉴욕에서 열리는 '갤럭시 언팩' 행사에서 공개할 폴더블 스마트폰에 엑시노스 칩셋을 일부 탑재한다. 삼성은 또 내년에 출시하는 갤럭시 S26 시리즈에는 엑시노스 2600을 부분 탑재할 계획이다. 해당 칩셋은 2나노 공정이 처음으로 적용되는 제품이다. 업계 관계자는 "갤럭시 Z 플립7에 엑시노스 2500, 보급형인 Z 플립7 FE에 2400이 각각 탑재될 예정"이라며 "상위 기종인 Z 폴드7에는 S25와 동일하게 퀄컴의 스냅드래곤8 엘리트가 들어간다"고 귀띔했다. 그러면서 "내년 상반기 출시 예정인 갤럭시 S26 시리즈의 경우 북미·한국·중국·일본 등 주요 시장에는 퀄컴의 새로운 칩(스냅드래곤8 엘리트2)을, 유럽 및 기타 글로벌 시장에는 자체 칩셋인 엑시노스 2600을 교차 탑재하는 것이 현재 계획"이라며 "단, 고성능이 요구되는 울트라 모델은 전량 퀄컴 칩셋을 탑재하는 방향으로 준비 중"이라고 설명했다. 앞서 삼성전자는 분기보고서를 통해 "상반기에는 3나노, 하반기에는 2나노 모바일향 제품을 양산해 신규 출하할 예정"이라고 밝힌 바 있다. 갤럭시 S25 울트라. [사진=삼성전자] Z 폴드7과 S26 시리즈의 칩셋 탑재 방식 차이는 제품 포지셔닝에 따른 것이다. 폴드 시리즈는 플립 보다 상위 라인업으로 분류돼 퀄컴 칩셋을 적용하고, 유럽 등에서는 엑시노스를 투입해 성능을 검증하는 방식을 채택했다. 울트라 모델의 경우 상위 기종인 만큼 지역에 관계없이 퀄컴 칩셋을 탑재하는 것으로 해석된다. 삼성이 엑시노스를 자사 제품에 탑재하는 것은 시스템LSI와 파운드리 사업부 실적 정상화 측면에서 의미가 있다. 올해 1분기 두 사업부는 각각 1조원대 적자를 낸 바 있다. 시스템LSI는 주요 고객사에 플래그십 SoC(System on Chip)를 공급하지 못했고, 파운드리는 계절적 수요 약세와 고객사 재고 조정으로 인한 가동률 정체로 실적이 부진했다. 하지만 자체 칩셋 적용은 내부 수요를 통한 생산 가동률 확보, 공정 검증 및 설계-제조 일원화 구조를 유지하는 효과를 기대할 수 있다.  업계 또 다른 관계자는 "삼성전자는 민감도가 낮은 시장을 중심으로 엑시노스 경쟁력을 확보하며 중장기적으로 점유율을 확대하는 전략을 추진하는 것으로 관측된다"며 "엑시노스의 성공은 사업부 실적은 물론 향후 시장 주도권 확보와도 연결되기 때문에 삼성 입장에선 중요한 문제"라고 말했다. 삼성전자 측은 엑시노스 탑재와 관련해 "고객사와 관련된 내용은 확인이 어렵다"고 답변했다. aykim@newspim.com 2025-05-21 14:00
안다쇼핑
Top으로 이동