전체기사 최신뉴스 GAM
KYD 디데이
오피니언 외부칼럼

속보

더보기

[기고] 상상이 영상으로 만들어지는 세상

기사입력 : 2024년02월19일 08:36

최종수정 : 2024년02월19일 09:10

※ 본문 글자 크기 조정

  • 더 작게
  • 작게
  • 보통
  • 크게
  • 더 크게

※ 번역할 언어 선택

하민회 이미지21대표(코가로보틱스 마케팅자문)

눈을 감고 상상해보자. '스타일리시한 여성이 빛나는 네온과 도시 간판으로 가득한 도쿄 거리를 걷는다. 빨간색 긴 드레스에 검은 가죽 재킷을 걸치고 검은색 부츠, 검은색 가방을 든 그녀는 빨간 립스틱에 선글라스를 끼고 자신감 있고 자연스럽게 걷고 있다. 보행자들이 지나가고. 거리는 축축하고 바닥엔 다채로운 조명이 반사되어 거울 효과를 만들어낸다.'

머릿속에 그린 것 이상으로 생생한 장면이 바로 몇 분만에 영상으로 만들어진다. (https://openai.com/sora 에서 상상의 영상을 확인할 수 있다) 오픈AI에서 발표한 동영상 생성AI 소라(Sora)이야기다.

15일 챗GPT를 만든 오픈AI는 공식 홈페이지와 X(전 트위터)를 통해 문장을 입력하면 영상을 만들어주는 '텍스트 투 비디오(Text to Video)' 모델인 소라를 공개했다. 다양한 프롬프트 예시와 보기 영상을 함께 게재한 오픈AI는 "모든 동영상은 소라가 생성한 동영상이고, 어떠한 수정을 하지 않았다"고 밝혔다.

소라가 만든 여러 편의 영상들은 실제로 현장에서 직접 촬영하거나 그래픽 작업으로 만든 애니메이션과 구분이 어려울 만큼 정교하고 생생하다. 피부 결, 주름, 머리카락, 미세한 미소 같은 인물의 움직임이 현실의 사람과 혼돈될 만큼 자연스럽고, 시시각각 변하는 배경은 마치 사람이 계획해 촬영을 진행한 것처럼 다양한 구도를 보여준다.

소라의 놀라운 영상 퀄리티에 외신들은 '영상 제작의 혁명'이라고 했고 AI영상 분야의 선두 기업 런웨이의 CEO는 "게임이 시작됐다"는 소감을 남겼다.

오픈AI의 '소라'로 만든 동영상 캡처 [사진=오픈AI 사이트] 2024.02.16 kwonjiun@newspim.com

동영상 생성은 텍스트나 이미지 생성보다 훨씬 어렵고 까다로운 기술이다. 기술적, 계산적, 창조적 측면에서 복잡성이 증가하기 때문이다.

동영상은 시간에 따라 변화하는 일련의 이미지(프레임)의 연결로 구성된다. 당연히 각 프레임은 시간적으로 연속적이고 일관성 있어야 한다. 그런데 지금까지 나온 AI 동영상 생성물에서는 같은 영상 안에서도 캐릭터나 사물의 형태가 조금씩 달라져 완성도가 떨어진다는 지적을 받아왔다.

복잡한 내러티브와 맥락을 이해하는 능력도 요구된다. AI가 단순히 물체를 인식하고 생성하는 것을 넘어서, 그 물체들이 상호작용하는 방식과 이를 통해 전달하고자 하는 메시지나 이야기에 대한 이해가 선행되어야 자연스러운 동영상을 생성해낼 수 있기 때문이다. AI 모델에게 더 많은 지능적 이해와 추론 능력이 요구되는 셈이다.

특히 한두 줄의 프롬프트에 따라 완성형 비디오를 만들어 내는 것은 언어로 표현되지 않은 부분과 시간의 흐름까지 고려할 수 있어야 한다. 이는 단순히 이미지가 영상 속에서 연계되는 패턴만을 학습하는 게 아니라 현실 세계에서의 물리적 규칙을 내재화하고 이를 시나리오에 적용해야 함을 의미한다.

오픈AI는 기술 보고서를 통해 '다양한 방법을 사용해 비디오 데이터 생성 모델링을 연구했다'고 밝혔다.

하민회 이미지21 대표.

AI가 언어를 정확하게 이해해서 적합한 비디오를 생성할 수 있도록 비디오에 관해 설명돼 있는 캡션이 포함된 비디오를 학습시켰고 달리3(DALL·E 3)에 적용된 시각 데이터를 훈련해 언어 이해 품질을 높였다.

또 오픈AI는 동영상과 이미지를 '패치'라는 작은 데이터 단위 모음으로 표현하는데 마치 언어모델의 '토큰'과 유사한 방식으로 작동한다고 설명했다. 데이터를 표현하는 방법을 통합함으로써 다양한 기간, 해상도 및 종횡비에 걸쳐 이전보다 더 광범위한 시각적 데이터에 대한 확산모델 트랜스포머(Diffusion model Transformer)를 교육할 수 있었다고 한다.

가장 인상적인 것은 "소라가 실제 세계를 이해하고 시뮬레이션 할 수 있는 모델의 기반역할을 하며 이 기능은 AGI 달성을 위한 중요한 이정표가 될 것이라 믿는다"는 문구였다. 한 마디로 실제 세계의 범용 시뮬레이터 구축을 위한 경로를 개발하는 중이라는 것이다.

물론 소라는 아직 기술적으로 완벽하지 않다. 오픈AI는 소라가 복잡하고 물리적인 장면을 묘사하거나 인과관계를 충분히 이해하지 못하는 경우가 있다고 밝혔다. 예를 들어 사람이 쿠키를 한입 베어 무는 장면의 다음 장면에 쿠키를 깨문 자국이 나타나지 않거나 오른쪽과 왼쪽이 공간 내에서 섞이기도 하고 물리적으로 불가능한 움직임을 만들어낼 수도 있다는 것이다.

현재 오픈AI는 소라를 시각 예술가, 디자이너, 영화 제작자 등 제한된 수의 크리에이티브 전문가에게만 공개하고 피드백을 받고 있다.

딥 페이크 우려 등에 대해 오픈AI는 "극단적인 폭력이나 혐오스러운 이미지, 또는 특정 인물의 초상을 요청하는 명령어는 거부하게 조치할 것"이라며 모든 비디오는 표시되기 전 각종 안전 정책을 준수하는지 확인을 거칠 것이라 밝혔다. 오픈AI는 소라가 생성한 영상이 식별되도록 하는 도구도 개발 중이다.

삼성전자와 러시아 인공지능연구소가 사진 이미지 한장을 이용해 자연스러운 딥페이크 영상을 만들어냈다. [제공=삼성전자] 

오픈AI 가세로 AI 동영상 생성 시장은 한층 뜨거워질 전망이다.

지난해 6월 런웨이는 획기적인 기능의 '젠2' 출시로 업계 선두로 나섰고 11월에 스태빌리티 AI가 '스테이블 비디오 디퓨전'을 내놓았다. 메타의 '에뮤', MS의 비디오 생성 모델 '드래그누와', 구글의 시공간 확산 모델 '루미에르' 등도 끼어들었다. 

광고·영상 업계에선 곡소리가 들린다. 최대 1분 분량의 영상을 생성해내는 소라의 등장에 숏폼, 광고 영상 제작업체들은 직격탄을 피하기 어려워 보인다. 굳이 다수의 스태프들과 시간들이고 비용 들여 로케이션 갈 필요도 없다. 현실보다 더 현실적인 AI생성 영상이 반갑지만은 않은 이유다.

멸종한 매머드가 눈발을 헤치고 달려오고 벚꽃 사이로 눈이 내리는 드라마틱한 영상이 단 몇 줄의 프롬프트만으로 가능하다니. 오죽하면 IT 전문 매체 기즈모도가 "소라는 현실감이란 개념에 거대한 엿(Fuck)을 날리는 서비스"라 했을까?

AI 발 일자리 감소가 피부로 와닿는 요즘, 소라는 두 가지 화두를 던진다.

우선 콘텐츠, 엔터테인먼트업계에 대한 위협. 지난 해 미국 헐리우드의 작가와 배우 노동조합의 동반파업이 떠오른다. 두 집단 파업에는 넷플릭스 등 OTT 플랫폼 재상영에 대한 정당한 대가요구도 있었으나, 생성 AI로 인한 생존의 위협에 대한 호소가 컸다. AI가 쓴 초고와 수정에 따른 저작권 인정 문제, AI로 인한 초상권 침해 문제, 성우 목소리를 활용한 AI보이스 등 대부분 기술 발전으로 인해 새로 생겨난 문제들이었다. 그리고 대개의 경우 여전히 밀고 당기는 해결과정에 있다.

AI를 형상화한 이미지 [자료=블룸버그]

과연 시간과 비용, 인력을 절감한 생산성 향상만이 정답일까?

생성AI의 등장과 함께 거의 모든 산업과 업종에서 숙련도 높은 고능력자만 일자리 유지가 가능 해졌다. 경험과 업계 지식이 부족한 신입의 시장 진입은 나날이 어려워지고 있다.

AI 기술은 빛의 속도로 발전하는데 AI로 인해 생겨난 사회적 문제에 대응할 시간은 턱없이 부족하다. AI로 인해 재편되는 일자리에 대한 교육, 저작권과 초상권, 개인보호법에 관한 법적 제도적 규제 등 준비하고 해결해야 할 사안들이 쌓여간다. 너무 늦어지기 전에 논의하고 합의할 필요가 있다.

다음은 딥 페이크와 가짜뉴스 문제.

소라의 극사실적인 영상을 보며 신기함과 두려움을 함께 느끼는 건 아마도 예상되는 부작용을 직감하기 때문일 것이다. 접근이 용이하고 사용이 쉬울수록 기술의 오용과 남용은 증가하기 마련이다. 최근 미국에선 중고교학교 딥 페이크 폭력으로 인한 자살자가 늘고 있다고 한다.

기술을 멈추거나 금지할 수 없다면 법적인 규제 못지 않게 문명의 이기를 슬기롭게 사용하는 법부터 알려 줄 필요가 있다. AI로 남을 속이거나 해를 입히거나 사회 혼란을 야기해서는 안 된다는 기본부터 강조하고 반복해야 한다. 엄격한 법적 책임을 묻고 학교 교육이든 사회적 캠페인이든 AI리터러시 교육을 꾸준히 지속해야 한다.

AI 기술의 화려함에 현혹되면 자칫 '모든 기술은 결국 인간을 이롭게 하기 위함'이라는 기본명제를 깜박할 수도 있기 때문이다.

◇하민회 이미지21대표(코가로보틱스 마케팅자문) =△경영 컨설턴트, AI전략전문가△ ㈜이미지21대표, 코가로보틱스 마케팅자문△경영학 박사 (HRD)△서울과학종합대학원 인공지능전략 석사△핀란드 ALTO 대학 MBA △상명대예술경영대학원 비주얼 저널리즘 석사 △한국외대 및 교육대학원 졸업 △경제지 및 전문지 칼럼니스트 △SERI CEO 이미지리더십 패널 △KBS, TBS, OBS, CBS 등 방송 패널 △YouTube <책사이> 진행 중 △저서: 쏘셜력 날개를 달다 (2016), 위미니지먼트로 경쟁하라(2008), 이미지리더십(2005), 포토에세이 바라나시 (2007) 등

[뉴스핌 베스트 기사]

사진
[써보니] 트라이폴드 태블릿과 다르다 [서울=뉴스핌] 김정인 기자 = 삼성전자가 2일 공개한 3단 폴더블폰 '갤럭시 Z 트라이폴드'를 현장에서 직접 사용해보니 예상보다 가볍고 얇은 형태가 먼저 느껴졌다. 크기와 구조상 무게가 상당할 것이란 우려가 있었지만, 실제로 들어보면 생각보다 부담이 덜한 편이다. 다만 한 손으로 오래 들고 쓰기에는 다소 무리가 있고, 전용 케이스나 거치대를 함께 사용할 때 가장 안정적인 사용감이 나온다. 펼친 화면은 태블릿을 떠올리게 할 만큼 넓고 시원하지만, 두 번 접어 휴대할 수 있다는 점은 기존 태블릿과 확실히 다른 경험을 만든다. 동시에 두께·베젤 등 초기 모델의 구조적 한계도 분명히 느껴졌다. ◆ 10형 대화면의 시원함…멀티태스킹 활용도↑ 가장 인상적인 요소는 화면을 펼쳤을 때의 시야다. 10형 대화면은 영상 시청 시 몰입감이 크고 웹 검색·문서 작업에서도 확 트인 느낌을 준다.  [서울=뉴스핌] 김정인 기자 = 삼성전자 '갤럭시 Z 트라이폴드'를 다 펼친 모습. 2025.12.02 kji01@newspim.com [서울=뉴스핌] 김정인 기자 = 삼성전자 '갤럭시 Z 트라이폴드'로 3앱 멀티태스킹을 진행하는 모습. 2025.12.02 kji01@newspim.com 특히 최대 3개의 앱을 동시에 띄워놓는 멀티태스킹 기능은 생산성 관점에서 기존 폴더블보다 한 단계 더 진화했다는 느낌이 강했다. 세 개의 스마트폰 화면을 한 번에 펼쳐 놓은 듯한 넓이가 확보돼, 동시에 여러 작업을 처리하기에 충분한 공간감이 느껴졌다. 이메일·인터넷·메모장 등 업무 앱을 한 화면에서 자연스럽게 배치할 수 있고, 영상 콘텐츠를 켜둔 채 작업을 이어가는 것도 충분히 가능하다. [서울=뉴스핌] 김정인 기자 = 삼성전자 '갤럭시 Z 트라이폴드'로 영상 시청을 하는 모습. 2025.12.02 kji01@newspim.com ◆ 구조에서 오는 한계도 분명…베젤·힌지·두께는 '새로운 폼팩터의 숙제' 새로운 구조 특성상 아쉬운 부분도 있다. 우선 베젤이 비교적 두꺼운 편이다. 화면을 여러 번 접는 구조라 물리적 여유 공간 확보가 필수적이다 보니 테두리가 두드러져 보인다. 상단 롤러(힌지 유닛 일부로 보이는 구조물)도 시각적으로는 다소 낯설게 느껴진다. 화면 연결부 자체는 자연스럽지만, 힌지 구조물 자체는 어색하게 보일 수 있다. [서울=뉴스핌] 김정인 기자 = 삼성전자 '갤럭시 Z 트라이폴드'를 닫은 모습. 2025.12.02 kji01@newspim.com 또 하나는 완전히 접었을 때의 두께감이다. 구조상 여러 패널이 겹치는 형태라 다 접어놓으면 두껍게 느껴지는 것은 불가피하다. 다만 이는 구조에 따른 필연적인 결과로, 사용성에 치명적일 정도의 부담은 아니었다. [서울=뉴스핌] 김정인 기자 = 삼성전자 '갤럭시 Z 트라이폴드'는 왼쪽 화면부터 닫아야 한다. 반대로 닫으려 할 시 경고 알람이 울린다. 2025.12.02 kji01@newspim.com 또 하나 눈에 띄는 점은 접는 순서가 고정돼 있다는 점이다. 오른쪽→왼쪽 순으로 접도록 설계돼, 반대로 접으려 하면 경고 알람이 울린다. 폼팩터 특성상 불가피한 방식이지만, 초기에 적응 과정이 필요하다. ◆ 태블릿과 겹치는 모습…그러나 휴대성이라는 확실한 차별점 사용 경험을 종합하면 '트라이폴드'는 태블릿과 유사한 역할을 상당 부분 수행한다. 대화면 기반의 콘텐츠 소비·문서 작업·멀티 환경 등 핵심 사용성은 태블릿과 맞닿아 있다. [서울=뉴스핌] 김정인 기자 = 삼성전자 '갤럭시 Z 트라이폴드'가 거치대에 놓인 모습. 2025.12.02 kji01@newspim.com 그러나 폴더블 구조로 접어서 주머니·가방에 넣을 수 있다는 점은 태블릿이 따라올 수 없는 차별점이다. 이동이 잦은 사용자에게는 '태블릿과 스마트폰의 중간 지점'에 있는 새로운 선택지가 될 수 있다. 강민석 모바일경험(MX)사업부 스마트폰PP팀장(부사장)은 "태블릿은 주머니에 넣고 다닐 수 없다. 태블릿은 대화면 그 자체의 장점이 있지만, 트라이폴드는 두께·무게 측면에서 소비자가 어디든 가져갈 수 있다는 점에서 혁신을 만들었다"며 "트라이폴드는 기존 태블릿과는 차원이 다른 새로운 카테고리라고 믿는다"고 말했다. ◆ 가격은 부담되지만…경쟁사 대비 '상대적 우위' 가격은 여전히 소비자에게 큰 장벽이다. 출고가 359만400원은 스마트폰 범주에서 결코 가볍지 않은 금액이다. 다만 경쟁사 제품들과의 상대 비교에서는 다른 해석도 가능하다. 중국 화웨이는 올해 출시한 트라이폴드폰을 1만7999위안(약 350만 원)부터 책정했다. 고용량 모델로 갈 경우 2만1999위안(약 429만 원)까지 올라간다. [서울=뉴스핌] 김정인 기자 = 임성택 삼성전자 한국총괄 부사장이 '갤럭시 Z 트라이폴드'를 소개하고 있다. 2025.12.02 kji01@newspim.com 이 기준에서 보면 삼성의 359만 원대 가격은 화웨이 평균 가격보다 낮은 편으로 비교된다. 특히 고용량 기준 화웨이 최고가와의 비교에서는 약 70만 원 가까운 차이가 나, '삼성이 가격 경쟁력까지 고려했다'는 해석이 가능하다. 또 시장에서는 출시 전부터 트라이폴드 구조상 부품 단가가 높아 400만 원 안팎이 될 것이라는 전망이 우세했다. 실제 출고가는 이 예상보다 낮게 형성되면서, 삼성이 새로운 카테고리 안착을 위해 가격선을 일정 수준까지 조정했다는 평가도 나온다. kji01@newspim.com 2025-12-02 11:48
사진
박대준 쿠팡 대표 "'자발적 배상도 고려" [서울=뉴스핌] 남라다 기자 = 박대준 쿠팡 대표가 "패스키 한국 도입을 검토하겠다"고 밝혔다. 박 대표는 3일 국회 정무위원회 현안질의에서 "한국 쿠팡에서 패스키를 도입할 계획이 있나"라는 이헌승 국민의힘 의원 질의에 이같이 답변했다. [서울=뉴스핌] 윤창빈 기자 = 박대준 쿠팡 대표이사가 3일 서울 여의도 국회 정무위원회에서 열린 쿠팡 개인정보 유출 관련 현안질의에서 의원 질문에 답변하고 있다. pangbin@newspim.com 이 의원은 "대만 쿠팡에서 글로벌 기준에 부합하는 전용 패스키 기술을 독자 개발하고 보급했다"며 "한국에 패스키를 도입했다면 이런 사고가 일어났겠냐"고 강하게 질타했다. 이어 "우리 대한민국에도 바로 대만처럼 대처할 수 있습니까"라고 따져물었다. 이 의원 질의에 박 대표는 "의원님 말씀에 공감하고 깊이 책임감 느끼고 있습니다"며 "조속히 (한국)에 도입될 수 있도록 검토하겠습니다"고 말했다. 소송을 통한 배상 대신 자발적으로 배상 조치하라는 질의에 대해 "적극적으로 검토하겠다"고 전했다. nrd@newspim.com 2025-12-03 15:54
기사 번역
결과물 출력을 준비하고 있어요.
종목 추적기

S&P 500 기업 중 기사 내용이 영향을 줄 종목 추적

결과물 출력을 준비하고 있어요.

긍정 영향 종목

  • Lockheed Martin Corp. Industrials
    우크라이나 안보 지원 강화 기대감으로 방산 수요 증가 직접적. 미·러 긴장 완화 불확실성 속에서도 방위산업 매출 안정성 강화 예상됨.

부정 영향 종목

  • Caterpillar Inc. Industrials
    우크라이나 전쟁 장기화 시 건설 및 중장비 수요 불확실성 직접적. 글로벌 인프라 투자 지연으로 매출 성장 둔화 가능성 있음.
이 내용에 포함된 데이터와 의견은 뉴스핌 AI가 분석한 결과입니다. 정보 제공 목적으로만 작성되었으며, 특정 종목 매매를 권유하지 않습니다. 투자 판단 및 결과에 대한 책임은 투자자 본인에게 있습니다. 주식 투자는 원금 손실 가능성이 있으므로, 투자 전 충분한 조사와 전문가 상담을 권장합니다.
안다쇼핑
Top으로 이동