로그인
토토사이트
먹튀사이트/제보
업체홍보/구인
신규사이트
지식/노하우
놀이터홍보
판매의뢰
스포츠분석
뉴스
후기내역공유
커뮤니티
포토
포인트
보증업체
카지노 먹튀
토토 먹튀
먹튀제보
구인
구직
총판
제작업체홍보
카지노
토토
홀덤
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
토토 홍보
카지노 홍보
홀덤 홍보
꽁머니홍보
신규가입머니
제작판매
제작의뢰
게임
축구
야구
농구
배구
하키
미식축구
스포츠뉴스
연예뉴스
IT뉴스
카지노 후기
토토 후기
홀덤 후기
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[]
“자녀가 오징어 손질 회사 물려받기 싫다네요”... 정부, 후계자 없는 中企 M&A 지원 박차
N
[IT뉴스]
갤S27 ‘프로’ 추가될까…삼성, 부품값 상승에 출고가 고민
N
[]
중국어까지 쓴 트럼프의 최고환대…習의 답은 “투키디데스 함정”
N
[]
트럼프·시진핑, '협력' 강조했지만 AI 온도차..."한반도 의견 교환"
N
[]
트럼프·시진핑 3시간22분 회담 종료…트럼프 "매우 좋은 회담"
N
커뮤니티
더보기
[유머★이슈]
바란 은퇴보다 더 소름돋는점
[유머★이슈]
오늘 국군의날 예행연습에 최초 공개된 장비들
[유머★이슈]
손흥민이 한국 병역 시스템에 영향 끼친 것.
[유머★이슈]
시댁의 속터지는 스무고개식 대화법
[유머★이슈]
엄마. 나 여자 임신시켜버렸어
목록
글쓰기
[IT뉴스]영상·음성·음악까지…콘텐츠 제작 바꾸는 특화 AI
온카뱅크관리자
조회:
4
2026-09-25 06:07:25
<div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">구글·런웨이·일레븐랩스·수노 등 분야별 서비스 확산 <br>국내도 영상·음성·음악 분야 특화 기업 잇따라</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="bLik6gFYJh"> <p contents-hash="e2e527bbc30a0d829c207f969084c8605df0ab462d968a68db5529ad9892af96" dmcf-pid="KonEPa3GLC" dmcf-ptype="general">유튜브나 인스타그램, 틱톡 등에서는 인공지능(AI)으로 만든 그래픽과 내레이션이 들어간 영상을 어렵지 않게 볼 수 있다. 실제 인물인 줄 알았는데 AI로 만든 영상이었다거나, 가수가 부른 노래인 줄 알았는데 AI로 제작된 음악인 경우도 있다. 실제 카페나 음식점 등에서도 저작권료 부담을 줄이기 위해 AI 음악을 재생하는 모습을 흔히 볼 수 있다.</p> <div contents-hash="f2e55920152d2dfd617194f95438f954d3ee5402368ce8871d412ac4ec8aa60e" dmcf-pid="9gLDQN0HiI" dmcf-ptype="general"> 이런 콘텐츠를 만드는 데는 챗GPT나 클로드처럼 언어를 중심으로 작동하는 범용 AI만으로는 한계가 있다. 영상과 음성, 음악 데이터를 각각 학습한 전용 모델이나 여러 모델을 제작 과정에 맞게 연결한 서비스가 필요하다. 이들 서비스는 단순히 결과물을 제작할 수 있는 단계를 넘어 원하는 장면과 목소리, 음악을 부분 수정할 수 있는 기능까지 확대하며 편의성을 높이고 있다. </div> <figure class="figure_frm origin_fig" contents-hash="6c5a6555411713e1b0ee48adc1f4a637ef8e17c6480607f415638f3edc8df341" data-idxno="453219" data-type="photo" dmcf-pid="2jamRcu5LO" dmcf-ptype="figure"> <p class="link_figure"><img alt="영상·음성·음악 등 특정 작업에 특화된 생성형 AI를 사용하는 모습을 표현한 이미지 / 챗GPT 생성" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/25/552810-SDi8XcZ/20260925060007551fyfw.png" data-org-width="1280" dmcf-mid="7sYnBMWInT" dmcf-mtype="image" height="auto" src="https://img4.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/25/552810-SDi8XcZ/20260925060007551fyfw.png" width="658"></p> <figcaption class="txt_caption default_figure"> 영상·음성·음악 등 특정 작업에 특화된 생성형 AI를 사용하는 모습을 표현한 이미지 / 챗GPT 생성 </figcaption> </figure> <p contents-hash="336fa2ab0428db390ee4cbc6dd9241a6553967def77fc9177889dcf98b589e8d" dmcf-pid="VANsek71es" dmcf-ptype="general"><strong>사진 한 장이면 영상 제작…카메라 움직이며 다른 장면도 만들어</strong></p> <div contents-hash="48dfedb6a4ac1fe5f292db957ff06bd7b2d7234ba3ea4519213fb2769b39e5d0" dmcf-pid="fcjOdEztdm" dmcf-ptype="general"> 영상 분야에서는 구글 딥마인드(Google DeepMind)의 '비오 3.1(Veo 3.1)'과 런웨이(Runway), 힉스필드(Higgsfield) 등이 경쟁하고 있다. 비오 3.1을 이용하면 영상과 대사·효과음을 함께 생성하고, 참고 이미지를 활용해 같은 인물의 외형을 여러 장면에서 유지하거나 카메라 움직임도 지정할 수 있다. 런웨이는 자체 영상 생성 모델 '젠4.5(Gen-4.5)'와 기존 영상을 자연어 지시로 수정하는 '알레프 2.0(Aleph 2.0)'을 제공한다. 비오 3.1 등 외부 모델도 같은 플랫폼에서 쓸 수 있어 영상 생성부터 장면 수정까지 한곳에서 작업할 수 있다. </div> <figure class="figure_frm origin_fig" contents-hash="cf17010a6300980b7472ddc9bf1b8fc3fa9ee9966ee68c9f64c75880d7e189f9" data-idxno="453218" data-type="photo" dmcf-pid="4kAIJDqFLr" dmcf-ptype="figure"> <p class="link_figure"><img alt="'힉스필드'를 사용하면 여러 영상 생성 AI 모델을 단일 플랫폼에서 편리하게 사용할 수 있고, 결과물의 수준도 크게 향상된다는 평가다. / 힉스필드 홈페이지 갈무리" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/25/552810-SDi8XcZ/20260925060009035ghrm.png" data-org-width="1280" dmcf-mid="zRABypjJJv" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/25/552810-SDi8XcZ/20260925060009035ghrm.png" width="658"></p> <figcaption class="txt_caption default_figure"> '힉스필드'를 사용하면 여러 영상 생성 AI 모델을 단일 플랫폼에서 편리하게 사용할 수 있고, 결과물의 수준도 크게 향상된다는 평가다. / 힉스필드 홈페이지 갈무리 </figcaption> </figure> <p contents-hash="2e739661fbe1568e74a6ed2e06158b4f5dc17bd80c361f568a99d963266641e4" dmcf-pid="8EcCiwB3ew" dmcf-ptype="general">힉스필드(Higgsfield)는 여러 영상 생성 모델을 실제 촬영 도구처럼 사용할 수 있도록 묶은 AI 영상 제작 플랫폼이다. 최신 '시네마 스튜디오 4.0(Cinema Studio 4.0)'에서는 카메라 종류와 렌즈, 조리개, 카메라 움직임을 직접 지정하고 색감과 조명, 편집 속도, 인물의 감정까지 조절할 수 있다. 최대 50개의 참고 이미지를 활용해 인물이나 제품의 모습을 유지하면서 최대 30초 길이의 영상을 만들 수 있다. 비오와 클링, 시댄스 등 여러 영상 모델도 한 플랫폼에서 선택해 사용할 수 있다.</p> <p contents-hash="7fed29bf2eb44fe14b035b5ec8764c48e83507bedb3fac82a4f7197048d5f6ab" dmcf-pid="6Dkhnrb0JD" dmcf-ptype="general">국내에서는 모피어스 스튜디오(Morpheus Studio)가 AI 콘텐츠 제작 플랫폼 '에이크론(AICRON)'을 운영한다. VFX 제작 경험을 바탕으로 이미지와 영상, 음성, 3D, 텍스트 등 260개 이상의 AI 기능을 한곳에 모아 콘텐츠 제작 과정에서 연결해 쓸 수 있도록 했다.</p> <p contents-hash="c2d72bed048f5dde79721f606b9f76e69868281ff2869a638737c66b519ae645" dmcf-pid="PwElLmKpiE" dmcf-ptype="general">스튜디오프리윌루전(Studio Freewillusion)은 생성형 AI를 실제 영상 제작에 적용하는 데 집중한다. 기획과 시나리오부터 AI 영상 제작, 후반작업까지 전 과정에 AI를 활용하며 삼성디스플레이·KT·볼빅 등 기업 광고도 제작했다.</p> <p contents-hash="1e445ac2249943970c9f5b5d25a613a7ff3208cb3e8b2fcfaf2230f49062dfd8" dmcf-pid="QrDSos9URk" dmcf-ptype="general"><strong>음성, 읽어주는 AI에서 연기하는 AI로</strong></p> <p contents-hash="567929c682774dfe8d3f5ddaa80b9347251f584154b6462f10934e7206bcb925" dmcf-pid="xmwvgO2uJc" dmcf-ptype="general">음성 AI는 글을 자연스럽게 읽는 수준을 넘어 감정과 말투까지 표현하는 방향으로 발전하고 있다. 같은 문장을 놓고 웃거나 속삭이는 식으로도 읽을 수 있고, 여러 사람이 실제 대화하듯 서로 다른 목소리를 만들어내는 것도 가능하다.</p> <div contents-hash="f6c57c29249f5f0e988844967b1c1c107aa202cae290ef7c5d58458236df2c42" dmcf-pid="yKBPF2OcLA" dmcf-ptype="general"> 일레븐랩스(ElevenLabs)의 '일레븐 v3(Eleven v3)'는 이처럼 감정과 말투를 세밀하게 표현하는 데 초점을 맞춘 음성 생성 모델이다. 대본에 웃음과 한숨, 속삭임 같은 지시를 넣으면 이를 실제 음성 표현에 반영한다. 70개 이상의 언어를 지원하며, 대화 모드에서는 여러 화자가 주고받는 음성도 한 번에 생성할 수 있다. </div> <figure class="figure_frm origin_fig" contents-hash="a198556a2f762980880132f21b73a922c7b8cbb90f0598100381cff51a654fdf" data-idxno="453220" data-type="photo" dmcf-pid="W9bQ3VIkej" dmcf-ptype="figure"> <p class="link_figure"><img alt="일레븐랩스는 일반 나레이션부터 대화형 음성, 캐릭터, 광고, 교육, 소셜미디어 콘텐츠용 등 다양한 용도에 맞춘 AI 음성을 제공하며, 감정 표현까지 담을 수 있다. / 일레븐랩스 홈페이지 갈무리" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/25/552810-SDi8XcZ/20260925060010410qlsx.png" data-org-width="1221" dmcf-mid="qyik6gFYJS" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/25/552810-SDi8XcZ/20260925060010410qlsx.png" width="658"></p> <figcaption class="txt_caption default_figure"> 일레븐랩스는 일반 나레이션부터 대화형 음성, 캐릭터, 광고, 교육, 소셜미디어 콘텐츠용 등 다양한 용도에 맞춘 AI 음성을 제공하며, 감정 표현까지 담을 수 있다. / 일레븐랩스 홈페이지 갈무리 </figcaption> </figure> <p contents-hash="3eff53d39c2cf0d6aae82c88cb701d2de8d801ffbb13586346d03020713a5682" dmcf-pid="Y2Kx0fCEeN" dmcf-ptype="general">흄AI(Hume AI)의 '옥타브 2(Octave 2)'는 문장의 의미와 감정을 파악해 말하는 방식을 조절하는 음성 생성 모델이다. 문맥에 따라 발음과 높낮이, 속도, 강세 등을 바꾸고 속삭이거나 목소리를 높이는 표현도 만들어낸다. 현재 프리뷰로 제공되며 한국어를 포함한 11개 언어를 지원한다.</p> <p contents-hash="b4fb67d3b95dab5eca458d3a5cc3e40fc0dac21e12a6cc53c5eb66463fa08228" dmcf-pid="GaowxjpXia" dmcf-ptype="general">카테시아(Cartesia)는 AI 상담원이나 음성 비서처럼 실시간 대화가 필요한 분야에 집중한다. 자체 음성 생성 모델 '소닉 3.6(Sonic 3.6)'은 입력된 글을 빠르게 사람의 목소리로 바꿔주는 텍스트 음성 변환(TTS) 모델이다. 카테시아는 이를 음성 인식과 결합해 사람의 말을 듣고 곧바로 음성으로 답하는 AI 에이전트도 제공한다.</p> <p contents-hash="f8a96fda6419f4d0168599ccfce632a7be1f480bd29ce8c6647d057a7b5b5144" dmcf-pid="HNgrMAUZMg" dmcf-ptype="general">국내에서는 네오사피엔스(Neosapience)가 AI 음성 서비스 '타입캐스트(Typecast)'를 운영한다. 자체 개발한 음성 합성 파운데이션 모델 'SSFM 3.0'은 대화의 맥락과 의도를 파악해 상황에 맞는 감정과 말투, 강세를 자동으로 조절한다. 타입캐스트는 현재 700개 이상의 AI 음성을 제공하며 영상 나레이션과 광고, 캐릭터 대사 등 콘텐츠 제작에 활용할 수 있다.</p> <p contents-hash="76de720b9b9f37b05671f3356e4444f6e3b8a81fd77a0c596d8640efe1b29e2f" dmcf-pid="XjamRcu5do" dmcf-ptype="general">웨이브덱(WaveDeck)의 '볼리(VOLI)'는 개인 콘텐츠 제작자를 겨냥한 AI 음성 서비스다. 텍스트 음성 변환과 음성 변환을 지원하고, 5초 분량의 음성 샘플로 맞춤형 AI 목소리를 만들 수 있다. 원하는 연령대와 성별, 말투 등을 글로 설명하면 새로운 목소리를 생성하는 '보이스 디자인' 기능도 제공한다. 최근에는 웹페이지 주소를 입력하면 대본과 나레이션, 자막 등을 포함한 숏폼 영상을 만드는 'AI 쇼츠'까지 추가했다.</p> <p contents-hash="8bca550090086ed7201955adcb99a7b4934d343b948fd8550e2a89baacd779ef" dmcf-pid="ZANsek71dL" dmcf-ptype="general"><strong>음악, 한 곡 만들기 넘어 부분 수정까지</strong></p> <p contents-hash="2acd5d6471800fe85d8a21ccfa25868985420d6ea91d32737c3664e73bafc034" dmcf-pid="5cjOdEztdn" dmcf-ptype="general">음악 AI는 한 곡을 통째로 만드는 데서 나아가 원하는 부분을 고치고 다시 섞는 제작 도구로 발전하고 있다.</p> <p contents-hash="71ae9e7bb4fc0771f050955c04f603eecfe3f9028426f20e0b5899954b5080a8" dmcf-pid="1kAIJDqFii" dmcf-ptype="general">수노(Suno)가 이달 공개한 최신 음악 생성 모델 'v6'는 자연어 지시로 노래를 만들고, 완성된 곡의 특정 구간만 다시 수정할 수 있다. 여러 곡에서 보컬과 드럼 등을 가져와 하나의 곡으로 섞거나 특정 연주를 떼어 새로운 음악을 만드는 기능도 지원한다.</p> <p contents-hash="9e07e361edd5aa97b433a7e325bb68f0ba1cb716d0f5c5e343dadc5d5dd34e0b" dmcf-pid="tEcCiwB3LJ" dmcf-ptype="general">유디오(Udio)도 AI로 노래를 생성한 뒤 특정 구간이나 가사를 다시 고칠 수 있다. 이용자가 직접 올린 음원을 바탕으로 곡을 이어 만들거나 리믹스하고, 분위기와 스타일을 바꾸는 기능도 제공한다.</p> <div contents-hash="298270078ef8866144cc0bb5aa61c4ebeddc8a53756bad226f296a2d704fd4d1" dmcf-pid="FDkhnrb0nd" dmcf-ptype="general"> 구글 딥마인드(Google DeepMind)의 '리리아 3.5(Lyria 3.5)'는 텍스트로 최대 3분 길이의 음악을 생성한다. 보컬과 가사를 포함한 곡을 만들고 길이와 스타일을 조절할 수 있으며, 이미지를 입력해 그 분위기에 맞는 음악을 만드는 기능도 제공한다. </div> <figure class="figure_frm origin_fig" contents-hash="3f565b49a58f3a4178ff84d568bb7972b28ffaf0d68e5f820565106bd9bf2595" data-idxno="453221" data-type="photo" dmcf-pid="3wElLmKpRe" dmcf-ptype="figure"> <p class="link_figure"><img alt="수노의 '뮤레카' 서비스를 이용하면 간단한 프롬프트 입력만으로 음악을 만들 수 있다. / 뮤레카 홈페이지 갈무리" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/25/552810-SDi8XcZ/20260925060011721bvow.png" data-org-width="1280" dmcf-mid="Bup2HzEoLl" dmcf-mtype="image" height="auto" src="https://img2.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/25/552810-SDi8XcZ/20260925060011721bvow.png" width="658"></p> <figcaption class="txt_caption default_figure"> 수노의 '뮤레카' 서비스를 이용하면 간단한 프롬프트 입력만으로 음악을 만들 수 있다. / 뮤레카 홈페이지 갈무리 </figcaption> </figure> <p contents-hash="aff2f77b0e0fa892739ebc4ebd462923feee698efeb1d579cedfed6bf0b2838e" dmcf-pid="0rDSos9UiR" dmcf-ptype="general">국내에서는 포자랩스(POZAlabs)가 AI 음악 창작 플랫폼 '라이브(LAIVE)'를 운영한다. 장르와 분위기, 키워드 등을 입력하면 음악과 가사, 보컬을 함께 생성한다. 기업용 음악 제작 서비스 '포자스튜디오(Poza Studio)'도 운영하며 광고와 방송, 공연 등 실제 콘텐츠 제작에 AI 음악을 적용하고 있다.</p> <p contents-hash="a4973a1108aaaa81a241f7afb6bbd9259fbdf90218731c30935a8c235388f007" dmcf-pid="pmwvgO2uLM" dmcf-ptype="general">뉴튠(Neutune)은 '믹스오디오(MixAudio)'를 통해 정식으로 라이선스를 확보한 음악을 AI로 리믹스하는 데 초점을 맞추고 있다. 리믹스 과정에서 사용된 보컬과 멜로디 등 음악 요소의 출처와 이용 내역을 추적해 권리자에게 정산하는 기술도 함께 개발한다. 텍스트와 이미지, 영상 등을 활용해 음악을 만들고 편집하는 AI 음악 에이전트도 준비하고 있다.</p> <p contents-hash="017ab1f86c74ab3cd1c5a68ce8bd45bb299615592cfc05ef2f073b4f4f79e07b" dmcf-pid="UsrTaIV7Mx" dmcf-ptype="general">특화 AI 업체들이 시장에서 살아남기 위해 선택한 전략은 모두 제각각이다. 자체 모델을 만드는 곳이 있는가 하면 여러 회사의 모델과 편집 기능을 하나의 제작 도구로 묶은 곳도 있다. 트웰브랩스처럼 콘텐츠를 새로 만들기보다 기존 영상을 잘 이해하는 데 집중하는 기업도 있다. 다만 공통점은 이용자가 원하는 작업을 정교하지만 더 쉽게 처리하도록 만드는 데 있다. 결국 각자의 분야를 얼마나 깊게 이해하고 사용자들에게 완성도 있는 결과물을 제공할 수 있느냐가 몇년 후 이들의 생존을 좌우할 전망이다.</p> <p contents-hash="21dbc3bb3b3b5d00fe71b49ca2d78c079b205a5676d969aafe87328d92650685" dmcf-pid="uvlZDyx2iQ" dmcf-ptype="general">정종길 기자<br>jk2@chosunbiz.com</p> </section> </div> <p class="" data-translation="true">Copyright © IT조선. 무단전재 및 재배포 금지.</p>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
놀이터홍보
더보기
[홀덤 홍보]
텍사스홀덤 핸드 순위- 홀카드의 가치
[홀덤 홍보]
텍사스홀덤 핸드 순위 - 프리플랍(Pre-Flop) 핸드 랭킹
[토토 홍보]
미니게임개발제작 전문업체 포유소프트를 추천드립니다.
[토토 홍보]
2023년 일본 만화 판매량 순위 공개
[토토 홍보]
무료만화 사이트 보는곳 3가지 추천
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기