전체기사 최신뉴스 GAM 라씨로
KYD 디데이

베일벗은 네이버 '초거대 AI'...구글·MS 대항마 될까

기사입력 : 2023년08월25일 14:24

최종수정 : 2023년08월25일 16:08

'1조 투자' 초거대 AI '하이퍼클로바X' 전격 출시
글로벌 빅테크와 경쟁 본격화…생성형 AI 춘추전국시대
"자체기술 탑재 후 환각 현상 72% 감소"

[서울=뉴스핌] 배요한 기자 = 네이버가 3년 동안 1조원을 투자해 개발한 초거대 인공지능(AI) 모델 '하이퍼클로바X'가 베일을 벗었다. 마이크로소프트, 구글 등 글로벌 빅테크들과의 AI 경쟁도 본격화 됐다. 

25일 업계에 따르면 전날 네이버는 팀네이버 컨퍼런스 '단 23'을 개최하고 초대규모 AI '하이퍼클로바'를 개발한 이후 2년 만에 업그레이드 모델 '하이퍼클로바X'를 공개했다.

이날 컨퍼런스에서 네이버는 하이퍼클로바X를 적용한 세 가지의 서비스를 소개했다. 대화형 AI 서비스인 '클로바X(CLOVA X)', 기업 생산성 향상을 위한 AI 플랫폼 '프로젝트 커넥트X(Project CONNECT X)' 그리고 비즈니스에 최적화된 AI 개발도구 '클로바 스튜디오(CLOVA Studio)'다.

네이버 관계자는 "20년 이상 축적된 데이터 자산을 활용해 한국 최적의 생성형 AI 모델을 구현했다"며 "기존 사업인 검색, 커머스, 광고, 클라우드, 웹툰 등 콘텐츠 사업 전반에 적용함으로써 소비자와 셀러, 개발자, 기업 모두의 편의성 및 업무효율성을 향상시킬 수 있다"고 밝혔다.

최수연 네이버 대표이사가 24일 그랜드 인터컨티넨탈 서울 파르나스에서 열린 팀네이버 컨퍼런스 'DAN 23'에서 차세대 생성형 AI인 '하이퍼클로바X' 기술을 소개하고 있다.[사진=네이버]

◆ 글로벌 초대형 빅테크와 경쟁 본격화..."챗GPT 대결 승률 75%" 

네이버가 초거대AI 모델 하이퍼클로바X를 공식 발표하면서 오픈 AI의 '챗GPT'으로 시작된 '생성형 AI' 시장은 그야말로 춘추전국시대가 열리게 됐다. 현재 오픈AI의 'GPT', 구글의 '팜2', 마이크로소프트(MS)의 'GPT-4' 등 해외 빅테크들의 거대 언어 모델(LLM)이 시장을 선도하고 있는 가운데 네이버가 이들에 맞서 경쟁력을 입증할 수 있을지 관심이 쏠린다.

네이버는 이번에 출시한 '하이퍼클로바X의 파라미터(parameter, 매개변수)를 공개하지 않았다. 매개변수는 입력된 데이터에서 원하는 출력값을 얻기 위해 AI가 찾아내야 하는 변수로, 통상 이 수치가 높으면 우수한 AI모델이라고 평가받는다.

다만 이전 모델인 하이퍼클로바의 성능지표로 하이퍼클로바X의 성능을 가늠해볼 수 있다. 지난 2021년 네이버가 공개한 하이퍼클로바의 매개변수는 2040억개다. 반면 오픈AI가 개발한 초거대 AI 'GPT-3.5'의 매개변수는 1750억개로 하이퍼클로바X보다 낮다 수준이다.

단순 수치상으로 비교해볼 때 네이버의 하이퍼클로바X는 챗GPT에 적용된 초거대AI보다 성능 면에서 우위에 있다고 볼 수 있는 셈이다.

성낙호 네이버클라우드 하이퍼스케일 AI 기술 총괄은 "초거대 규모의 언어모델의 성능을 어떤 하나의 수치로 비교하는 것은 어렵다"라면서도 "내부적으로 우리 모델과 GPT-3.5의 시뮬레이션을 진행해본 결과 75%의 높은 승률을 기록했다"고 말했다. 

생성형 AI의 문제점으로 지적돼온 '환각(hallucination) 현상'에 대해서도 좋은 평가를 받았다. 대표적 대화형 AI 서비스인 챗GPT는 환각현상이 빈번하게 나타나 정확도가 중요한 검색 서비스에 부적절하다는 논란이 있었다. 반면 하이퍼클로바X는 내부 테스트 결과, 자체기술 탑재 후 환각 현상이 72% 감소한 것으로 알려졌다. '환각 현상'은 생성형 인공지능 서비스가 사실이 아닌 것을 사실처럼 말하는 현상이다. 

네이버는 오는 11월 단일 기업으로는 아시아 최대 규모인 60만 유닛 이상의 서버를 수용할 수 있는 하이퍼스케일 데이터센터 '각 세종'을 오픈할 예정이다. '각 세종'은 초대규모AI의 브레인센터 역할을 수행하게 된다.

◆ '국내용' 우려...저작권 논란 '불씨'

네이버에 따르면 하이퍼클로바는 GPT-3보다 한국어 데이터를 약 6500배 이상 학습한 것으로 알려졌다. 한국어 데이터 학습 기반을 통해 영어 형식의 챗 GPT보다 자연스럽고 이해하기 쉬운 한국어로 답변을 해줄 수 있다는 평가가 나온다.

하이퍼클로바X가 영어 중심의 오픈AI '챗GPT'나 구글의 '바드'와 달리, 한국 시장에서 유리한 고지를 선점한 것은 분명하지만, '국내용'이라는 우려의 목소리도 적지 않다. 실제 네이버는 컨퍼런스에서 구체적인 해외 진출 계획을 공개하지 않았다.

최수연 네이버 대표는 해외 시장 진출을 묻는 질문에 "하이버클로바X가 영어·일본어 등 여러 외국어도 굉장히 잘한다"면서도 "이길 수 있는 시장을 먼저 잡기 위해 한국 타깃의 국내 스타트업 수요를 맞춘 것으로, 글로벌 진출 요구에도 대응하겠다"며 모호한 답변을 내놨다. 

성낙호 네이버 총괄은 "유니버셜하게 전체에 대한 데이터를 학습한다면 그걸 똑같은 성능을 발휘하는 인공지능을 만드는 과정에서 훨씬 더 고비용 구조를 가질 수밖에 없다"라며 "우리는 생성형 AI에서도 로컬라이즈된 사업 전략이 필요하다고 생각했고, 한국 시장에 특화된 모델을 만들고 경량화를 진행하고 있다"고 설명했다.

이제 막 개화하는 글로벌 생성형 AI 시장 전망은 굉장히 밝은 편이다. 스탠더드앤드푸어스(S&P) 글로벌 마케팅 인텔리전스가 조사한 전세계 생성형 AI 시장 규모는 올해 37억360만 달러(약 4조 9,606억원) 규모로 연평균 58% 성장해 2028년에는 10배 이상 성장할 것으로 예상했다. 그랜드 뷰 리서치는 Chat GPT 등 생성형 AI에서 비롯된 데이터 서비스 및 솔루션 수요가 2022년 글로벌 시장에서 약 90억 달러(약 11조 9502억원)를 기록했으며, 2030년에는 660억 달러(약 87조 6348억원) 규모로 급성장할 것으로 추정했다.

국내 생성형 AI 시장에 대한 구체적인 자료는 없지만, 국내 AI기업 매출액은 2020년 1조 9506억원에서 지난해 3조 9702억원으로 2배 이상 증가한 것으로 나타났다. 국내 AI 시장 규모가 증가 추세를 보이는 것은 확실하지만 글로벌 시장과 비교해서는 상당한 차이가 나는 셈이다.

네이버는 초거대AI 하이퍼클로바X를 개발하는데 3년동안 1조원 가량을 쏟아 부었다. 앞으로 기술 고도화에 따른 개발 비용으로 천문학적인 추가 비용이 투입될 수 있는 상황에서 해외 시장 점유율 확보는 필수적이다.

네이버가 풀어야할 숙제로 저작권 문제도 남아있다. 앞서 네이버는 보유한 50년치 뉴스와 9년치 블로그 데이터가 생성형AI 학습에 사용됐다며 저작권 논란에 휩싸였다.

최근 한국신문협회는 '생성형 인공지능(AI)의 뉴스 저작권 침해 방지를 위한 신문협회 입장'을 내고 "정당한 권한과 근거 없이 뉴스 콘텐츠를 AI 학습에 이용하는 것은 언론사가 뉴스 콘텐츠에 대해 갖는 저작권 및 데이터베이스(DB) 제작자로서의 권리를 침해하는 것"이라고 입장을 표명한 바 있다.

이와 관련해 최수연 대표는 "하이퍼클로바를 출시할 때 그 학습한 데이터의 규모를 알기 쉽게 전달하는 과정에서 '뉴스 50년치'가 아니고, 1년에 검색되는 뉴스 분량의 50배 혹은 블로그에 몇 배다 이런 식으로 비교해서 언급했는데 그 부분에서 오해가 있었던 것 같다"고 저작권 침해 사실을 부인했다.

Press Q&A에 최수연 대표와 성낙호 네이버클라우드 Hyperscale AI 기술총괄, 김용범 Search US AI 기술총괄, 최재호 AiRSearch 책임리더 등이 참석해 기자들의 질의에 답변했다.[사진=배요한 기자]

yohan@newspim.com

[뉴스핌 베스트 기사]

사진
LH, 올 매입·전세임대 9만가구 공급 [서울=뉴스핌] 최현민 기자 = 한국토지주택공사(LH)가 올해 총 19만가구 이상의 공공주택과 2만8000가구 규모 공공택지 공급에 나선다. 또 건설경기 회복을 위해 21조6000억원의 투자를 집행하고 재원조달 방식 등을 다양화해 재무여건 체질을 개선한다. 한국토지주택공사(LH)가 올해 21만 8000+α가구 규모의 주택 공급에 나선다. 사진은 이한준 한국토지주택공사(LH) 사장이 5일 서울 종로구 국립현대미술관에서 열린 서계동 복합문화단지 조성사업 업무협약식에서 인사말을 하고 있는 모습 [사진=뉴스핌DB] 23일 한국토지주택공사(LH)는 이같은 내용을 담은 '2025년도 업무계획'을 발표했다.  우선 핵심 업무인 주택 공급에 집중한다. 10만가구 사업승인과 매입·전세임대 9만가구 등 총 19만가구 이상의 공공주택을 공급한다. 동시에 민간 주택건설 활성화를 위해 2만8000가구 규모의 공공택지를 조성한다. 주택 착공물량은 지난해(5만가구) 대비 20% 증가한 6만가구를 추진하고 지난해 8·8 주택공급 활성화 방안에 포함된 서울서리풀 등 5만가구 규모의 사업지구 역시 인허가 일정을 최대한 단축해 안정적 공급 기반을 마련할 계획이다. 도심 내 신속한 주택공급과 비아파트 시장 정상화를 위해 신축매입임대 5만가구 이상을 공급하고 전세사기 피해자 회복 지원을 위해 피해 주택 7500가구를 매입한다. 올해 주택 승인물량의 37%를 청년·신혼·고령자에게 공급하고 출산가구 우선공급(통합공임)과 실버스테이 등 새로운 유형의 시니어 주택을 통해 가속화되는 저출산·고령화 문제에도 적극 대응할 계획이다. 아울러 쪽방·고시원·반지하 거주자의 주거 상향 지원을 지속하고 예술인 등 다양한 수요층에 부응한 특화형 매입임대도 확대한다. 공공주택은 합리적 가격의 고품질을 보장한다. 무엇보다 최근 급등한 주택 분양가격을 낮춰 국민들의 내 집 마련을 돕는다. 이를 위해 사업지구별 목표 원가를 설정해 관리와 검증을 강화하고 가처분면적 확대와 사업일정 단축으로 조성원가를 인하해 합리적인 가격에 공급한다는 계획이다. 공공주도의 기술개발을 통해 민간기업을 선도할 수 있도록 모듈러주택 표준평면 개발 등 OSC 공법을 올해부터 단계적으로 고도화하고 LH가 개발한 층간소음 1등급 설계기준과 국내 최대규모의 층간소음 시험시설(데시벨35랩)을 활용해 주택 품질 혁신을 추진한다. 관련 예산은 조기 집행한다. 전체 공공기관 투자계획(66조원)의 33% 수준인 21조6000억원을 차질 없이 집행할 계획이다. 특히 상반기 역대 최대 규모인 57% 이상의 투자를 집행한다. 지역 건설경기 회복을 위해 지방 준공 후 미분양 아파트 3000가구를 매입하고 1기 신도시 특별정비계획 수립, 용인 반도체 국가산단 조성 등도 차질없이 추진한다. 손실 최소화 등 재무여건을 안정적으로 관리하기 위해 재원조달 방식도 개선한다. 광명시흥 등 대규모 사업지구에 LH와 기금이 함께 출자하는 신도시 리츠를 설립해 사업에 따른 재무부담을 완화한다. 또 토지 패키지형 공모 등 지구별 특성과 시장 여건에 맞춘 다양한 매각 방식을 도입해 판매여건 개선과 대금 회수를 촉진할 예정이다. 이와 함께 임금 직접지급 관리를 강화하고 설게 등 공모에 참여하는 외부 심사위원의 정성평가 비중을 축소해 업체 선정의 공정성을 제고한다. 이한준 LH 사장은 "국민의 삶과 국가 경제가 어려운 만큼, 올해도 신속한 주택공급과 투자집행 등 LH가 맡은 역할을 충실히 이행할 것"이라며 "선도적인 공적 역할을 통해 확실한 정책성과를 창출하여 국민 주거안정을 지원하고 국가 경제회복의 마중물 역할을 다하겠다"고 말했다. min72@newspim.com 2025-02-23 20:07
사진
헌법재판관들 "공정" 49.3% "불공정" 44.9% [서울=뉴스핌] 이바름 기자 = 윤석열 대통령의 탄핵 심판을 맡은 헌법재판관들의 공정성을 묻는 질문에 '공정하다' 49.3%, '공정하지 않다' 44.9%로 팽팽했다. 종합뉴스통신사 뉴스핌이 미디어리서치에 의뢰해 지난 18~19일 전국 만 18세 이상 남녀 1000명을 대상으로 진행해 20일 발표한 ARS(자동응답 시스템) 조사에서 윤 대통령 탄핵 심판 헌법재판관들의 공정성을 묻는 질문에 49.3%가 '공정하다'고 응답했다. '불공정하다'는 답변은 44.9%로 오차범위 내였다. 5.8%는 '잘모름'이었다. 연령별로 보면 30·40·50대는 '공정'이 우세했고, 만18세~29세·60대·70대 이상은 '불공정' 응답이 많았다. 만18세~29세는 공정하다 44.7%, 불공정하다 47.8%, 잘모름은 7.5%였다. 30대는 공정하다 52.2%, 불공정하다 40.4%, 잘모름 7.3%였다. 40대는 공정하다 61.3%, 불공정하다 34.8%, 잘모름 3.9%였다. 50대는 공정하다 61.3%, 불공정하다 35.2%, 잘모름 3.6%였다. 60대는 공정하다 40.7%, 불공정하다 53.8%, 잘모름 5.5%였다. 70대 이상은 공정하다 31.6%, 불공정하다 60.4%, 잘모름은 8.0%였다. 지역별로는 서울과 경기·인천, 광주·전남·전북은 '공정'으로 기울었다. 대전·충청·세종과 강원·제주, 부산·울산·경남, 대구·경북은 '불공정'하다고 봤다. 서울은 공정하다 52.9%, 불공정하다 41.5%, 잘모름 5.6%였다. 경기·인천은 공정하다 50.8%, 불공정하다 44.0%, 잘모름 5.1%였다. 대전·충청·세종은 공정하다 41.8%, 불공정하다 50.7%, 잘모름은 7.4%였다. 강원·제주는 공정하다 44.6%, 불공정하다 48.6%, 잘모름 6.8%였다. 부산·울산·경남은 공정하다 43.8%, 불공정하다 49.3%, 잘모름 6.9%였다. 대구·경북은 공정하다 37.7%, 불공정하다 56.4%, 잘모름은 5.9%였다. 광주·전남·전북은 공정하다 28.2%, 불공정하다 67.6%, 잘모름 4.2%였다. 지지정당별로는 더불어민주당 지지자들은 88.7%가 공정하다고 답했다. 반면 국민의힘 지지자들은 90.0%가 불공정하다고 응답했다. 조국혁신당 지지자들은 84.4%가 공정하다고 봤다. 개혁신당 지지자들은 공정하다 48.0%, 불공정하다 46.9%로 팽팽했다. 진보당 지지자들은 59.5%가 공정하다, 잘모름 27.0%, 불공정하다는 13.5%였다. 무당층은 51.8%가 공정하다, 32.9%는 불공정하다. 잘모름은 15.3%였다. 성별로는 남성 53.6%는 공정하다, 42.1%는 불공정하다였다. 여성은 45.1%가 공정하다, 47.7%는 불공정하다고 답했다. 박상병 정치평론가는 "우리사회의 마지막 성역이었던 헌법재판관의 양심까지도 공격하는 시대"라며 "대통령 탄핵 인용 또는 기각 이후 다음 정권에도 이러한 갈등은 더 심해질 것으로 예상한다"고 전했다. 김대은 미디어리서치 대표는 "지지층에 따라 서로 상반된 입장이 나오고 있어 향후 헌재에서 대통령 탄핵 기각과 인용중 어떠한 판결을 내리더라도 상당한 혼란이 있을 것으로 보인다"고 말했다. 이번 여론조사는 무선 RDD(무작위 전화 걸기)를 활용한 ARS를 통해 진행됐다. 신뢰 수준은 95%, 표본 오차는 ±3.1%p. 응답률은 7.2%다. 자세한 조사 개요 및 내용은 미디어리서치 홈페이지와 중앙선거여론조사심의위원회 홈페이지를 참조하면 된다. right@newspim.com 2025-02-20 11:00
안다쇼핑
Top으로 이동