전체기사 최신뉴스 GAM
KYD 디데이
경제 과학기술

속보

더보기

서울과기대·테디썸, 라마3-70B 기반 한글 특화 LLM '블라썸' 세계최초 공개

기사입력 : 2024년05월09일 14:21

최종수정 : 2024년05월09일 14:21

※ 본문 글자 크기 조정

  • 더 작게
  • 작게
  • 보통
  • 크게
  • 더 크게

※ 번역할 언어 선택

라마3 70B 모델에 한국어 확장 첫 사례
업스테이지·솔트룩스·마음AI에 도전장
블라썸, 기본 모델 대비 89% 답변 향상

[세종=뉴스핌] 이경태 기자 = 국내 연구진과 인공지능(AI) 기업이 공동연구를 통해 메타의 오픈소스 거대언어모델(LLM)을 활용한 한국어 어휘 확장 대형 모델을 세계 최초로 개발했다. 

이미 오픈소스 기반 LLM 개발 업체인 업스테이지, 솔트룩스, 마음AI에 한발 앞선 기술력으로 도전장을 내민 셈이다.

서울과학기술대학교 다층퍼셉트론(MLP)연구실과 테디썸은 9일 오후께 한국어 최초 70B급 한국어-영어 초거대 언어모델 블라썸(Bllossom)을 완전 공개했다. 이는 현재 가장 좋은 성능으로 평가받는 공개 언어모델인 라마3(LLama3-70B) 기반 모델 중 어휘 확장 모델로는 전세계에서 최초로 꼽힌다.

메타는 지난달 18일(현지 시간) 자체 개발한 오픈소스 거대언어모델(LLM)인 라마(Llama)의 3세대 버전을 무료로 출시했다. 라마 3는 8B 및 70B 매개변수 두 모델로 우선 공개됐다. 라마3은 15조 개의 토큰으로 학습됐다. 

이 가운데 70B 모델은 오픈AI가 개발한 GPT-3.5보다 성능이 좋고 GPT4 성능에 근접한 수준이라는 평가를 일부 받는다. 라마3는 한국어에 특화돼 있는 모델로 평가된다.

테디썸이 라마3 70B 모델을 활용해 자체 개발한 한국어 특화 확장 거대언어모델인 '블라썸'을 허깅페이스에 9일 게재했다. 실제 전체 공개는 이날 오후께 진행된다. [사진=테디썸] 2024.05.09 biggerthanseoul@newspim.com

서울과기대와 테디썸은 라마3 70B모델에 추가적인 어휘확장을 했다.

어휘 확장은 특정 언어의 단어를 추가해 심층적인 표현이 가능하도록 하는 방법이다. 70B급 거대 언어모델은 어휘를 확장하면 새로운 어휘의 표현학습을 위해 엄청난 추가 학습시간 및 비용이 소요된다. 이렇다보니 70B급 모델에 어휘확장이 시도된 사례는 한국어에서는 아직 찾아볼 수 없다. 

이번 블라썸 모델은 서울과기대 슈퍼컴퓨팅센터의 컴퓨팅 지원을 토대로 대량의 GPU를 활용해 어휘확장 및 영어-한국어 지식 연결 학습이 가능했던 것으로 파악됐다.

임경태 서울과기대 인공지능응용학과 교수 연구팀은 이번 모델 개발을 위해 ▲한국어 표현력 강화를 위한 3만개가 넘는 한국어 어휘 추가 ▲한국어 어휘 표상 학습을 위한 대규모 사전학습 ▲한국어-영어 지식 연결을 위한 Parallel 학습 ▲한국어-영어 지식 표현을 위한 지시미세조정(Instruction Tuning) ▲사용자 피드백(feedback) 기반의 강화학습 등을 진행했다.

방대한 영어 지식을 한국어와 연결시키기 위해 직접 구축한 병렬(Parallel) 데이터 셋을 활용했다는 점과 언어학자들이 직접 구축한 정교한 지시미세조정 데이터가 성능을 크게 향상시켰다는 점이 이번 모델 개발에서 주목할 만한 요소다.

테디썸은 이번에 개발한 모델을 전체 공개해 개별적인 추가 학습과 상업적 이용이 가능하다는 점을 강조했다.

이번 모델은 한국어 토큰 확장으로 인해 25% 확장된 컨텍스트 활용이 가능하다. 인간평가와 GPT4 한국어 답변 선호도 평가 결과 GPT3.5와 유사하거나 약간 앞선 결과를 보인 바 있다. 라마3 70B 기본모델 대비 한국어 답변에 대해 89% 더 높은 답변 선호도 평가를 기록했다.

테디썸은 이미 8B 소형 모델은 전세계 기술 공유 플랫폼인 허깅페이스에 공개됐고 70B 거대모델도 이날 함께 공개했다. 개인 GPU에서 작동 가능한 4bit 양자화된 모델과 직접 활용해볼 수 있는 데모도 함께 내놓는다.

함영균 테디썸 대표는 "기존 빅테크에서만 연구개발하고 공개되지 않던 70B 거대 모델을 중소규모 회사 및 연구 그룹에서도 활용할 수 있도록 초거대 언어모델의 민주화에 기여했다는 점에서 의미있는 첫 발자국이라 생각한다"고 말했다.

한편 국내에서 라마3 소형 모델인 8B를 기반으로 자체 LLM 모델을 개발해 공개한 기업은 솔트룩스, 마음AI 등이다. AI 기업 데이터드리븐의 이준범 수석 AI 연구원도 개인적으로 8B 기반 모델을 공개한 바 있다.

biggerthanseoul@newspim.com

[뉴스핌 베스트 기사]

사진
감사원장 후보자에 김호철 변호사 지명 [서울=뉴스핌] 박성준 기자 = 이재명 대통령이 7일 감사원장 후보자로 김호철 변호사를 지명했다. 이규연 대통령실 홍보소통수석은 이날 용산 대통령실에서 브리핑을 열고 "이 대통령이 오늘 감사원장 후보로 김호철 변호사를 지명했다"고 밝혔다. 김호철 감사원장 후보자. [사진=대통령실] 김 후보자는 국가경찰위원회 위원장과 환경운동연합 공동대표, 민주사회를 위한 변호사 모임 회장 등을 역임한 인물로, 공공성과 사회적 가치 수호에 앞장서 온 대표적인 인권 변호사로 평가받고 있다고 이 수석은 설명했다. 이 수석은 "김 후보자가 경찰국 신설과 군 의문사 진상 규명 등 사회적 파장이 컸던 사안에서 공공성과 법적 원칙을 견지해 왔다"고 했다. 이 수석은 "김 후보자는 감사 운영의 정상화를 통해 감사원의 정치적 중립과 독립성, 그리고 국민 신뢰라는 헌법적 가치를 확고하게 복원할 적임자이자 전문가로 기대된다"고 말했다. parksj@newspim.com 2025-12-07 13:37
사진
내란 특검, 추경호·황교안 불구속 기소 [서울=뉴스핌] 김현구 기자 = 12·3 비상계엄 관련 내란·외환 의혹을 수사 중인 내란 특검팀(조은석 특별검사)이 7일 국민의힘 원내대표를 지낸 추경호 의원과 황교안 전 국무총리를 불구속 상태로 재판에 넘겼다. 추경호 국민의힘 의원. [사진=뉴스핌DB] 박지영 특검보는 추 의원에 대해 "피고인은 여당 원내대표로서 윤석열 전 대통령의 비상계엄 유지 의사를 조기에 꺾게 만들 수 있었던 유일한 사람이었음에도, 비상계엄 유지를 위한 협조 요청을 받고 국민의 기본권이 침해되고 무장한 군인에 의해 국회가 짓밟히는 상황 목도하고도 아무런 조치 취하지 않았다"고 지적했다. 이어 "국회의원 권한이자 의무인 표결권 행사에 참여하지 않았고, 본회의 개의를 알고도 의원총회 개최 의사도 없이 의총 소집 장소를 당사로 변경해 국회 진입 의사를 가진 국회의원의 발길을 돌리게 했다"고 덧붙였다. 그러면서 "또 본회의장에 있던 국회의원에게는 밖으로 나오라는 메시지 전달했는데, 이는 윤 전 대통령이 군인과 경찰을 동원해 국회를 봉쇄하고 본회의장에 들어가 있던 국회의원을 끌어내려 하려는 행위와 같이 평가된다"고 부연했다. 박 특검보는 "국회의원이 국회에 들어가지 못하는 것은 헌정 질서가 파괴되는 상황"이라며 "본인이 원내대표실에 있으면서 이런 파괴된 현장을 목도했기 때문에 그 부분에 대한 인식이 없었다 볼 수 없다"고 강조했다. 또 그는 "윤 전 대통령은 지난 한덕수 전 국무총리 재판에 나와서 '추 의원에게 어떤 이야기를 했는가'라는 재판장 질문에 '걱정하지 말라. 길게 가지 않고 빨리 해결될 것'이란 취지로 말했다. 이 말은 너희들이 국회 의결 해제하지 않고도 내가 끝낼 것이란 말"이라고 말했다. 이어 "추 의원은 충분히 본인의 역할을 지시받았고 이와 관련해 어떤 말도 하지 않았다고 한다"며 "추 의원은 '대통령님 이것은 말이 되지 않는다. 빨리 해제해달라'는 말을 한 번도 한 적 없다. 본인도 인정한다"고 덧붙였다. 아울러 박 특검보는 "비상계엄이 선포될 즈음 당대표는 체포 대상이 될 정도로 사실상 의사 소통 창구가 전혀 아니었고, 여당과의 의사 소통 통로이자 서로 논의할 수 있던 사람은 추 의원이 유일했다"며 "(추 의원은) 반대하는 의사를 표시하거나 이래선 안 된다는 의사표시는 하나도 없이 본인이 알고 있던 모든 것을 여당 의원에게 고지하지 않았다"고 비판했다. 끝으로 그는 "사실상 계엄이 국회의결로 해제되는 것은 아니다. 여당 원내대표마저 협조하지 않고 반기를 들었다면 계엄 해제가 빨라졌을 것"이라며 "계엄에 대한 문제 해결 방식이나 회복 시간 등이 상상 이상으로 빨라졌을 것이고, 국론 분열이나 사회적 혼란도 훨씬 더 줄어들었을 것"이라고 말했다. 추 의원은 지난해 12월 3일 윤 전 대통령이 비상계엄을 선포했을 당시 국민의힘 원내대표로서 의총 장소를 세 차례 변경하는 방법으로 자당 소속 의원들의 표결 참여를 방해한 혐의를 받는다. 이로 인해 당시 국민의힘 의원 108명 중 단 18명만이 계엄 해제 표결에 참여할 수 있었고, 국회 해제 요구 결의안은 결국 재석 190명 중 찬성 190명으로 통과됐다. 특검은 당시 추 의원이 국회 이동 과정에서 윤 전 대통령, 그의 측근들과 통화한 사실을 바탕으로 그가 의도적으로 표결을 방해했다고 판단했다. 앞서 특검은 추 의원에 대한 구속영장을 청구했으나 법원은 지난 3일 "혐의 및 법리에 대해 다툼의 여지가 있다"며 이를 기각했다. 황교안 전 국무총리. [사진=뉴스핌DB] 한편 특검은 이날 황교안 전 국무총리도 불구속 기소했다. 황 전 총리는 비상계엄 당시 "나라를 망가뜨린 종북주사파 세력과 부정선거 세력을 이번에 척결해야 한다", "우원식 국회의장을 체포하라. 대통령 조치를 정면으로 방해하는 한동훈 국민의힘 대표도 체포하라" 등의 게시물을 올려 내란을 선동한 혐의 등을 받는다. hyun9@newspim.com 2025-12-07 17:26
기사 번역
결과물 출력을 준비하고 있어요.
종목 추적기

S&P 500 기업 중 기사 내용이 영향을 줄 종목 추적

결과물 출력을 준비하고 있어요.

긍정 영향 종목

  • Lockheed Martin Corp. Industrials
    우크라이나 안보 지원 강화 기대감으로 방산 수요 증가 직접적. 미·러 긴장 완화 불확실성 속에서도 방위산업 매출 안정성 강화 예상됨.

부정 영향 종목

  • Caterpillar Inc. Industrials
    우크라이나 전쟁 장기화 시 건설 및 중장비 수요 불확실성 직접적. 글로벌 인프라 투자 지연으로 매출 성장 둔화 가능성 있음.
이 내용에 포함된 데이터와 의견은 뉴스핌 AI가 분석한 결과입니다. 정보 제공 목적으로만 작성되었으며, 특정 종목 매매를 권유하지 않습니다. 투자 판단 및 결과에 대한 책임은 투자자 본인에게 있습니다. 주식 투자는 원금 손실 가능성이 있으므로, 투자 전 충분한 조사와 전문가 상담을 권장합니다.
안다쇼핑
Top으로 이동