로그인
토토사이트
먹튀사이트/제보
업체홍보/구인
신규사이트
지식/노하우
놀이터홍보
판매의뢰
스포츠분석
뉴스
후기내역공유
커뮤니티
포토
포인트
보증업체
카지노 먹튀
토토 먹튀
먹튀제보
구인
구직
총판
제작업체홍보
카지노
토토
홀덤
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
토토 홍보
카지노 홍보
홀덤 홍보
꽁머니홍보
신규가입머니
제작판매
제작의뢰
게임
축구
야구
농구
배구
하키
미식축구
스포츠뉴스
연예뉴스
IT뉴스
카지노 후기
토토 후기
홀덤 후기
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[]
'결혼 축의금' 국가가 현금 100만원 준다...출산도 세액공제 대신 재정지원
N
[IT뉴스]
1030 사로잡은 '여권폰'…갤 Z 폴드8 디자인 비밀은?[모닝폰]
N
[]
[날씨] 서쪽 극한 폭염, 수도권 첫 '중대경보'...서울 38℃
N
[IT뉴스]
[새 폼팩터 표준화 전쟁]①4:3 비율이 대세…삼성·애플·화웨이 주도권 싸움
N
[IT뉴스]
KT, 피지컬AI 시동…"인프라로 승부"
N
커뮤니티
더보기
[유머★이슈]
바란 은퇴보다 더 소름돋는점
[유머★이슈]
오늘 국군의날 예행연습에 최초 공개된 장비들
[유머★이슈]
손흥민이 한국 병역 시스템에 영향 끼친 것.
[유머★이슈]
시댁의 속터지는 스무고개식 대화법
[유머★이슈]
엄마. 나 여자 임신시켜버렸어
목록
글쓰기
[IT뉴스]비용 낮추고 특화 성능 높인 '작은 AI' 등판…SLM 경쟁 본셕화
온카뱅크관리자
조회:
10
2026-08-04 06:37:29
<div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">GPU 공급난 장기화·토큰 비용 부담↑…에이전틱 AI에도 적합<br>애플, 온디바이스 AI 전략 집중…네카오, 자체 경량 모델 개발</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="V0FXRHXSZu"> <figure class="figure_frm origin_fig" contents-hash="68239f997e15db8b9aa23aa659edcdb9e347dc55d529c4239f7bd873ee39f6bc" dmcf-pid="fp3ZeXZvZU" dmcf-ptype="figure"> <p class="link_figure"><img alt="ⓒ 뉴스1 양혜림 디자이너" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/04/NEWS1/20260804063527849wpnr.jpg" data-org-width="560" dmcf-mid="2XYSflSr17" dmcf-mtype="image" height="auto" src="https://img2.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/04/NEWS1/20260804063527849wpnr.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> ⓒ 뉴스1 양혜림 디자이너 </figcaption> </figure> <p contents-hash="1947d1a8a48619cf252dd95141580728d8ddc302ae40fce7ea2d602bac67fafc" dmcf-pid="4onRTMRftp" dmcf-ptype="general">(서울=뉴스1) 유수연 기자 = 거대언어모델(LLM) 성능 경쟁이 이어지는 가운데 비용과 연산 부담을 줄인 경량언어모델(SLM) 경쟁도 본격화하고 있다.</p> <p contents-hash="385bec3b99752a365126c6e7e81f6497523f2a6811d918dd3b957e2d044bc8b2" dmcf-pid="8gLeyRe410" dmcf-ptype="general">특정 작업에 필요한 성능을 확보하면서 비용과 연산량을 낮출 수 있다는 장점에 글로벌 빅테크는 물론 국내 AI 기업들도 잇따라 경량 모델 개발과 공개에 나서고 있다.</p> <h3 contents-hash="20e0bce7e79ee7973215f60bb1600e3010fcd0a96171f91d20d069bf12961340" dmcf-pid="6aodWed8t3" dmcf-ptype="h3">연산 속도 빠르고 비용 부담 적어…에이전틱 AI에 '착붙'</h3> <p contents-hash="96b4b0953a9e655c94ecc8f5eb285731aae69bb951c12755188b7ad90996cb84" dmcf-pid="PNgJYdJ6GF" dmcf-ptype="general">4일 정보기술(IT) 업계에 따르면 경량언어모델은 거대언어모델보다 적은 수의 매개변수(파라미터)를 가진 AI 모델로, 반복적이고 목적이 명확한 작업을 효율적으로 처리하는 데 강점이 있다.</p> <p contents-hash="3b76e4ca1aaa7e049387fdf207c9c1cc88279d4583f0b7ad881754fbc30b6f4b" dmcf-pid="QjaiGJiPtt" dmcf-ptype="general">거대 모델보다 범용성은 다소 떨어질 수 있지만 연산 속도가 빠르고 추론 비용이 낮다. 온디바이스 AI 구현에 폭넓게 활용되는 동시에 AI 에이전트나 특정 목적의 AI 서비스에도 적용되고 있다.</p> <p contents-hash="6cc0039b09d55554844e8d4b0eb24efa64d3e2ba318004920fbd49bbba779b9f" dmcf-pid="xANnHinQX1" dmcf-ptype="general">AI 서비스 이용이 늘면서 추론 비용과 GPU 운영 부담이 커지자 모든 작업을 거대 모델이 처리하기보다 단말기나 소형 모델이 처리할 수 있는 작업은 경량 모델에 맡기는 방식이 확산할 것으로 전망된다. 스스로 판단하고 계획을 세워 필요한 작업을 수행하는 에이전틱 AI 확산도 경량 모델 수요를 키우고 있다.</p> <p contents-hash="8a86aaed83b1fe42d3b034d74d837e4a08b73453f9aba830a1a78fb5a76976c8" dmcf-pid="yU05dZ5Tt5" dmcf-ptype="general">엔비디아 리서치는 지난해 발표한 논문에서 "에이전틱 AI 시스템의 부상은 언어모델이 소수의 특화된 작업을 반복적으로 수행하는 사례를 만들어내고 있다"며 "경량언어모델은 에이전틱 AI 시스템의 많은 호출에서 충분한 성능을 제공하면서 비용 측면에서도 더 경제적"이라고 분석했다.</p> <h3 contents-hash="8b1e0f4322be405d68542a4db64fce00c7e19355212d682378e22f599e48bb32" dmcf-pid="Wup1J51ytZ" dmcf-ptype="h3">애플·구글·메타 이어 네카오도 속도…AI 경쟁 효율로</h3> <p contents-hash="942eb71a17a9d85710b5a28a323d7f66af0f906d0789716a29f43eed7b94eaac" dmcf-pid="Y7Uti1tWZX" dmcf-ptype="general">AI 경쟁이 '누가 더 큰 모델을 만드느냐'에서 '어떤 환경에서 가장 효율적으로 AI를 구현하느냐'로 확장되면서 빅테크들도 경량 모델 생태계 구축에 속도를 내고 있다.</p> <p contents-hash="bb322f81ddb6508c590b3508f16a8ba4c53a467734efade6a6fd45b7da8c5623" dmcf-pid="GzuFntFY5H" dmcf-ptype="general">구글은 개방형 모델 '젬마(Gemma)' 시리즈를 공개해 개발자 생태계를 확대하고 있다. 일부 모델은 온디바이스 환경에서도 활용할 수 있도록 설계됐다.</p> <p contents-hash="ea86db4b4406a9544daf69c36c7e31bc92a6ee8f153e45a00b387bc63720b854" dmcf-pid="H5Xy6TyOXG" dmcf-ptype="general">메타 역시 '라마(Llama)'의 경량 모델을 선보이며 온디바이스와 플랫폼 서비스에서 활용 범위를 넓히고 있다.</p> <p contents-hash="6d2ce0b1e08eedf3134e466036a1449892cd42fd946ed60cf5e48af2b9c075a9" dmcf-pid="X1ZWPyWIGY" dmcf-ptype="general">온디바이스 AI 전략에 무게를 둔 애플은 기기에서 직접 구동되는 경량 모델 개발을 강화했다. 복잡한 작업은 자체 프라이빗 클라우드 컴퓨트에서 처리하고, 가능한 작업은 기기 내부에서 수행하는 구조를 통해 개인정보 보호와 응답 속도를 함께 높이고 있다.</p> <p contents-hash="1dfe15b4c38b09ad4a6f6a79c0f4033363fa03f1cea47ba7987f1b027f1b9e2a" dmcf-pid="Zt5YQWYCYW" dmcf-ptype="general">국내 기업들도 경량 모델 경쟁력 확보에 속도를 내고 있다.</p> <p contents-hash="25bca16c2f037bfc18a318a54539b770946ad49f894018a54bdddf2fb6aac762" dmcf-pid="5F1GxYGh1y" dmcf-ptype="general">카카오(035720)는 최근 허깅페이스에 자체 개발 AI 모델 '카나나' SLM 시리즈 △Kanana-2-1.3B-base △Kanana-2-1.3B-instruct △Kanana-2-3B-base △Kanana-2-3B-instruct 등 4종을 공개했다.</p> <p contents-hash="f78bc9fac512e3bdf450ec9baa24d9a8a7720a2e9edf7da290b92f7c8a23e0b8" dmcf-pid="13tHMGHlGT" dmcf-ptype="general">카카오는 해당 모델이 비슷한 규모의 최신 공개 모델과 비교해 한국어와 영어, 지식, 수학, 코드 등 주요 벤치마크에서 경쟁력 있는 성능을 기록했다고 설명했다.</p> <p contents-hash="fcc1ec34d83eaa33a47acc47eaceacb0b9b9e1501f1f80dff8d1fbec29dbb1d5" dmcf-pid="t0FXRHXSYv" dmcf-ptype="general">네이버(035420)는 AI탭 서비스에 분업형 SLM 구조를 적용해 검색과 쇼핑, 플레이스 등 기능별로 모델이 역할을 나누도록 했다. 이를 통해 운영 비용은 기존 대비 3분의 1 수준으로 줄이고 응답 속도는 2배 이상 높였다고 밝혔다.</p> <p contents-hash="7ec2d29cc32a6b6320b45514406e756be1d4b60fabdf058a051ac5bc7859f3ee" dmcf-pid="Fp3ZeXZvXS" dmcf-ptype="general">또 하이퍼클로바X 시드 계열을 비롯한 경량 모델을 공개했으며, 최근에는 국방 특화 경량 옴니모달 모델 '하이퍼클로바X 시드 4B'도 선보였다.</p> <p contents-hash="60b3cda2bccafd91ae6186049ba30bdffab80a62dfa81491ef7a46f3ff01300b" dmcf-pid="3U05dZ5Ttl" dmcf-ptype="general">업계는 앞으로 거대 모델과 경량 모델이 경쟁하기보다 서로 역할을 나눠 활용하는 방향으로 발전할 것으로 보고 있다.</p> <p contents-hash="894916a2123a8ffe175aadcc3e27f8e0463509047aba157e047b3246c0957ddf" dmcf-pid="0up1J51yZh" dmcf-ptype="general">복잡한 추론과 범용 작업은 거대 모델이 담당하고, 빠른 응답과 비용 효율성이 중요한 작업은 경량 모델이 처리하는 방식이다. 이에 따라 AI 경쟁도 단순히 더 큰 모델을 만드는 데서 나아가 거대 모델과 경량 모델을 목적에 맞게 조합하고 운영하는 방향으로 확대될 것이라는 전망이 나온다.</p> <p contents-hash="11fcdf80fe3063365e0afeaeb283d580b1077b906367d554173c89018306509a" dmcf-pid="p7Uti1tW1C" dmcf-ptype="general">업계 관계자는 "거대 모델과 별도로 온디바이스에서 구동되는 경량 모델을 확보하는 것도 중요한 경쟁력이 되고 있다"며 "앞으로는 어떤 모델을 보유했느냐보다 어떤 작업에 어떤 모델을 배치해 효율적으로 운영하느냐가 서비스 경쟁력을 좌우하게 될 것"이라고 말했다.</p> <p contents-hash="3dd5a15b4580901556f116594acdf34213006103566f544e7cc7bdb4851f79f6" dmcf-pid="U7Uti1tWHI" dmcf-ptype="general">shushu@news1.kr<br><br><strong><용어설명></strong><br><br>■ 경량언어모델(SLM)<br>거대언어모델(LLM)에 비해 적은 수의 매개변수(parameter)를 가진 AI 모델로 반복적이고 특화된 작업을 효율적으로 처리하는 데 장점이 있다. 거대언어모델보다 범용성은 다소 떨어질 수 있지만 연산 속도가 빠르고 비용 부담이 적다는 것이 강점이다.<br><br>■ 온디바이스<br>기기 자체에서 수행되는 연산이나 처리. 데이터가 클라우드 서버 등으로 전송되지 않고 기기 내부에서 직접 처리된다.<br><br> </p> </section> </div> <p class="" data-translation="true">Copyright © 뉴스1. All rights reserved. 무단 전재 및 재배포, AI학습 이용 금지.</p>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
놀이터홍보
더보기
[홀덤 홍보]
텍사스홀덤 핸드 순위- 홀카드의 가치
[홀덤 홍보]
텍사스홀덤 핸드 순위 - 프리플랍(Pre-Flop) 핸드 랭킹
[토토 홍보]
미니게임개발제작 전문업체 포유소프트를 추천드립니다.
[토토 홍보]
2023년 일본 만화 판매량 순위 공개
[토토 홍보]
무료만화 사이트 보는곳 3가지 추천
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기