전체기사 최신뉴스 GAM
KYD 디데이
글로벌·중국 일본

속보

더보기

AI의 무서운 진화...도쿄대 입시 '합격 수준' 도달

기사입력 :

최종수정 :

※ 본문 글자 크기 조정

  • 더 작게
  • 작게
  • 보통
  • 크게
  • 더 크게

※ 번역할 언어 선택

[서울=뉴스핌] 오영상 기자 = 2022년 11월 오픈AI가 챗GPT를 세상에 내놓은지 2년여가 지났다. 기업은 물론 국가까지도 AI를 핵심 전략으로 삼고 있는 지금 AI는 과연 어디까지 진화했을까.

11일 니혼게이자이신문은 이제 AI는 일본에서 가장 난이도가 높다는 도쿄대학교 2차 시험의 수학 문제를 '합격 수준'으로 풀 수 있게 됐다고 전했다.

AI 이미지 [사진=픽사베이]

◆ 'o1' 등 추론 모델 등장하며 AI 급진화

지금까지 다른 과목에 비해 수학은 AI가 약한 분야였으며, 오픈AI의 초기 대화형 AI인 챗GPT는 간단한 산수 문제에서도 실수를 자주 범했다. 하지만 2024년 9월 이후 오픈AI의 'o1', 'o3' 등 추론 모델로 불리는 AI들이 속속 등장하면서 상황이 급변했다.

일본국립정보학연구소의 아라이 노리코 교수는 "o1은 2025년 2월 출제된 도쿄대 2차 시험의 이과 수학 문제뿐만 아니라 과거의 난이도 높은 문제들도 거의 풀어낼 수 있다"며 "도쿄대의 합격선을 넘어 상위 합격자 수준에 도달한 것 같다"고 말했다.

2024년 2월까지만 해도 챗GPT는 도쿄대 수학 문제를 전혀 풀지 못했다. 하지만 1년 만에 비약적인 발전을 이룬 것은 추론 모델의 등장 덕분이다. 추론 모델은 단순한 대규모 언어 모델(LLM)이 아니라 수학 등 논리적 사고가 필요한 문제 해결에 특화된 AI다.

o1과 o3 외에도 중국 딥시크의 'R1', 일론 머스크가 이끄는 xAI의 'Grok(그록) 3', 앤스로픽의 'Claude(클로드) 3.7 소넷' 등이 추론 능력이 뛰어난 모델로 평가된다.

오픈AI 챗GPT와 딥시크.[사진=로이터 뉴스핌]

◆ 美 수학올림피아드 정답률 90%에 육박

미국 수학올림피아드(AIME)의 정답률을 보면 AI의 급격한 발전이 더욱 뚜렷하게 드러난다.

2024년 5월 오픈AI가 발표한 'GPT-4o'의 AIME 정답률은 9.3%에 불과했다. 하지만 같은 해 9월 출시된 'o1 프리뷰'는 56.7%로 높아졌다, 이어 12월 정식 버전 o1은 83.3%, 2025년 1월 발표된 o3-mini는 87.3%로 급격히 향상됐다. R1과 그록 3의 정답률도 80~90%에 도달했다.

수학이나 프로그래밍과 같이 논리적 사고가 필요한 문제에서 추론 모델이 높은 성과를 낼 수 있는 메커니즘은 아직 명확하게 밝혀지지 않았다.

다만 올바른 추론을 했을 때 보상을 주는 '강화 학습', 문제를 단계별로 해결하는 '사고의 연쇄', 그리고 추론에 필요한 계산량(계산 시간) 증가 등의 기술이 성능 향상의 요인으로 꼽히고 있다.

추론 모델의 수학적 성능이 높다고 해도, 아직 인간 수학자처럼 극도로 어려운 문제를 해결하거나 새로운 정리를 창출할 수 있는 수준에는 이르지 못했다.

니혼게이자이는 "인간처럼 광범위한 지적 활동을 수행할 수 있는 범용 인공지능(AGI)이나, 인간 능력을 월등히 초월하는 인공지능(ASI)의 실현을 위해서는 여전히 기술적 돌파구가 필요하다"고 지적했다.

goldendog@newspim.com

[관련키워드]

[뉴스핌 베스트 기사]

사진
이부진, 아들 서울대 입학식 참석 [서울=뉴스핌] 남라다 기자 = 이부진 호텔신라 사장이 26일 서울 관악구 서울대학교에서 열린 2026학년도 입학식에 참석해 아들 임동현군의 입학을 축하했다. 이 사장은 이날 모친인 홍라희 리움미술관 명예관장과 함께 서울대를 찾아 임군의 입학을 기념해 사진을 찍기도 했다.  [서울=뉴스핌] 김현우 기자 = 이부진 호텔신라 사장(사진 왼쪽)과 홍라희 리움미술관 명예관장이 26일 서울 관악구 서울대학교 2026학년도 입학식에 참석해 아들 임동현군의 입학을 축하하고 있다.  khwphoto@newspim.com 임군은 최근 서울 휘문고등학교를 졸업하고 2026학년도 수시모집 전형으로 서울대 경제학부에 합격했다. 고교 시절 내신 성적이 상위권이었으며 대학수학능력시험에서도 한 문제만 틀린 것으로 알려졌다. 서울대 26학번이 된 임군은 외삼촌인 이재용 삼성전자 회장(서울대 동양사학과 87학번)의 후배가 됐다. 이날 입학식 현장에서 이 사장의 패션도 눈길을 끌었다. 이 사장은 크림색 계열의 디올 재킷에 에르메스 버킨백을 매치한 차분한 차림으로 참석했다. 단정한 헤어스타일과 절제된 스타일링으로 재계 인사다운 단아한 이미지를 보였다는 평가가 나왔다. [서울=뉴스핌] 김현우 기자 = 이부진 호텔신라 사장(사진 왼쪽)과 홍라희 리움미술관 명예관장이 26일 서울 관악구 서울대학교 2026학년도 입학식에 참석해 아들 임동현 군의 입학을 축하하고 있다. khwphoto@newspim.com nrd@newspim.com 2026-02-26 16:27
사진
李대통령 지지율 67% [NBS] [서울=뉴스핌] 김미경 기자 = 이재명 대통령의 국정운영 지지도가 취임 이후 최고치인 67%를 기록했다는 여론조사 결과가 26일 발표됐다. 이재명 대통령 국정운영 평가 2월4주차 [그래프=NBS] 엠브레인퍼블릭·케이스탯리서치·코리아리서치·한국리서치가 공동으로 수행하는 전국지표조사(NBS) 2월 4주차 결과를 살펴보면 이 대통령의 국정운영 긍정평가는 67%로 직전 조사인 2월 2주차 63%보다 4%포인트(p) 올랐다.  부정평가는 25%로 직전 조사 30%보다 5%p 떨어졌다. [서울=뉴스핌] 이재명 대통령이 지난 25일 서울 종로구 청와대에서 열린 제11차 확대국가관광전략회의 'K-관광, 세계를 품다'에서 미소를 짓고 있다. [사진=청와대] 2026.02.26 photo@newspim.com 정당 지지도에서는 더불어민주당 45%, 국민의힘 17%, 조국혁신당 4%, 개혁신당 3%, 진보당 1% 순으로 나타났고, 태도유보는 27%였다.  정당 대표의 직무수행 평가는 정청래 민주당 대표에 대한 긍정평가가 43%, 부정평가 42%였고, 장동혁 국민의힘 대표에 대한 긍정평가는 23%, 부정평가는 62%였다. NBS 정당지지도 2월4주차 [그래프=NBS] 6·3 지방선거와 관련해서는 여당에 힘을 실어줘야 한다는 의견이 53%, 야당에 힘을 실어줘야 한다는 의견이 34%로 집계됐다. 이재명 정부가 추진하는 다주택자 양도소득세 중과 유예 폐지에는 잘한 조치라는 찬성 의견이 62%, 잘못한 조치라는 반대 의견이 27%였다.  윤석열 전 대통령 1심에서 무기징역을 선고한 것에는 '혐의에 비해 가볍다'는 의견이 42%, '적절하다'는 의견이 26%, '무죄이므로 잘못됐다'는 의견이 23%였다.  이번 여론조사는 23~25일 동안 만 18세 이상 남녀 1002명을 대상으로 휴대전화 가상번호(100%)를 이용한 전화면접조사 방식으로 진행됐다. 응답률은 14.9%로, 표본오차는 95% 신뢰수준에서 ±3.1%p다. 자세한 사항은 중앙선거여론조사심의위원회 홈페이지를 참조하면 된다.  the13ook@newspim.com 2026-02-26 11:51
기사 번역
결과물 출력을 준비하고 있어요.
종목 추적기

S&P 500 기업 중 기사 내용이 영향을 줄 종목 추적

결과물 출력을 준비하고 있어요.

긍정 영향 종목

  • Lockheed Martin Corp. Industrials
    우크라이나 안보 지원 강화 기대감으로 방산 수요 증가 직접적. 미·러 긴장 완화 불확실성 속에서도 방위산업 매출 안정성 강화 예상됨.

부정 영향 종목

  • Caterpillar Inc. Industrials
    우크라이나 전쟁 장기화 시 건설 및 중장비 수요 불확실성 직접적. 글로벌 인프라 투자 지연으로 매출 성장 둔화 가능성 있음.
이 내용에 포함된 데이터와 의견은 뉴스핌 AI가 분석한 결과입니다. 정보 제공 목적으로만 작성되었으며, 특정 종목 매매를 권유하지 않습니다. 투자 판단 및 결과에 대한 책임은 투자자 본인에게 있습니다. 주식 투자는 원금 손실 가능성이 있으므로, 투자 전 충분한 조사와 전문가 상담을 권장합니다.
안다쇼핑
Top으로 이동