로그인
토토사이트
먹튀사이트/제보
업체홍보/구인
신규사이트
지식/노하우
놀이터홍보
판매의뢰
스포츠분석
뉴스
후기내역공유
커뮤니티
포토
포인트
보증업체
카지노 먹튀
토토 먹튀
먹튀제보
구인
구직
총판
제작업체홍보
카지노
토토
홀덤
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
토토 홍보
카지노 홍보
홀덤 홍보
꽁머니홍보
신규가입머니
제작판매
제작의뢰
게임
축구
야구
농구
배구
하키
미식축구
스포츠뉴스
연예뉴스
IT뉴스
카지노 후기
토토 후기
홀덤 후기
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[]
포스코, 사내 하청 노조와 창사 이래 첫 교섭… 노조 “사측 태도 따라 쟁의행위도 고려할 것”
N
[]
광복절 연휴 제주에 많은 비…"시간당 50㎜ 폭우 주의"(종합)
N
[]
안규백 "전작권 없는 젊은세대 마음아파…환수는 절대절명 과제"(종합)
N
[IT뉴스]
통신3사 상반기 '연봉킹' 홍범식 LGU+ 대표…18.2억 수령
N
[IT뉴스]
모티프, 글로벌 AI 평가서 1위?…‘AAII 점수’ 어디까지 믿어야 하나
N
커뮤니티
더보기
[유머★이슈]
바란 은퇴보다 더 소름돋는점
[유머★이슈]
오늘 국군의날 예행연습에 최초 공개된 장비들
[유머★이슈]
손흥민이 한국 병역 시스템에 영향 끼친 것.
[유머★이슈]
시댁의 속터지는 스무고개식 대화법
[유머★이슈]
엄마. 나 여자 임신시켜버렸어
목록
글쓰기
[IT뉴스]AI 싸움은 체급 순이 아니었다… 독파모 성적표 뒤집힌 이유 [핫 IT(잇)슈]
온카뱅크관리자
조회:
5
2026-08-14 16:27:30
<div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">모티프 47점·LG 31점, 스타트업 약진<br>750B K-엑사원보다 314B 모티프 앞서<br>대형화에 집중하다 최적화 놓쳤나<br>특정 시험 겨냥한 ‘벤치맥싱’ 논란도</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="1LWY9y8BaL"> <div contents-hash="6e985044436cce304d71066ff04b611a423f81dd856b93068329f59ad790a40b" dmcf-pid="toYG2W6bgn" dmcf-ptype="general"> <div> 빛의 속도로 변하는 IT 업계 주요 이슈를 짚고, 그 배경과 파장을 분석합니다. 인공지능(AI), 플랫폼, 통신, 클라우드, 반도체 등 기술 변화가 기업과 산업, 일상에 어떤 영향을 미치는지 쉽게 풀어서 전합니다. </div> <br> 어제(13일) 한 인공지능(AI) 모델 ‘성적표’가 국내 AI 업계를 술렁이게 했습니다. 스타트업 모티프테크놀로지스가 만든 AI 모델이 글로벌 성능 평가에서 LG AI연구원과 SK텔레콤의 대형 AI 모델을 크게 앞섰기 때문입니다. </div> <p contents-hash="de1d3244c1df3e7804bd0a96543426a8206639a1d102c646e285fe761bf1c8de" dmcf-pid="FgGHVYPKai" dmcf-ptype="general">이번 성적표는 각 기업이 홍보를 위해 자체적으로 실시한 평가가 아닙니다. 한국을 대표해 미국과 중국의 최첨단 AI 모델과 경쟁할 ‘국가대표 AI’를 뽑는 독자 AI 파운데이션 모델(독파모) 프로젝트 2차 평가에 실제 반영되는 지표입니다.</p> <figure class="figure_frm origin_fig" contents-hash="d1eef03c903fe0a7b6ae25ff32b19c24c19fb1f306a155c7f5dc377d4f9e036b" dmcf-pid="3aHXfGQ9kJ" dmcf-ptype="figure"> <p class="link_figure"><img alt="스타트업 모티프테크놀로지스가 만든 AI 모델이 글로벌 성능 평가에서 LG AI연구원과 SK텔레콤의 대형 AI 모델을 크게 앞섰다. 게티이미지뱅크" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/14/segye/20260814162330949guji.jpg" data-org-width="800" dmcf-mid="XEVfA2waga" dmcf-mtype="image" height="auto" src="https://img3.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/14/segye/20260814162330949guji.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> 스타트업 모티프테크놀로지스가 만든 AI 모델이 글로벌 성능 평가에서 LG AI연구원과 SK텔레콤의 대형 AI 모델을 크게 앞섰다. 게티이미지뱅크 </figcaption> </figure> <div contents-hash="6f1b6c0bd082124f7f1472eee5a4e9302f8783193c1540eac697fcb94ee7322a" dmcf-pid="0ktFQ1d8gd" dmcf-ptype="general"> 독파모 2차 평가는 100점 만점입니다. 수치로 모델 성능을 재는 벤치마크가 40점, 전문가 평가가 35점, 사용자 평가가 25점을 차지합니다. 벤치마크 40점 가운데 15점은 한국지능정보사회진흥원(NIA)이 평가하고, 나머지 25점은 글로벌 AI 평가기관 아티피셜 애널리시스(Artificial Analysis)의 ‘인텔리전스 인덱스(AAII)’를 활용합니다. </div> <p contents-hash="3809fa44ad10d54a7e177e4cd9fe1e461c23c1313813e62192c49c4cb3e447db" dmcf-pid="pEF3xtJ6ae" dmcf-ptype="general">정부가 독파모 2차 평가를 위해 아티피셜 애널리시스에 별도로 평가를 의뢰했고, 그 결과가 13일 공개된 겁니다. 평가 대상은 현재 독파모 경쟁을 이어가고 있는 SK텔레콤·LG AI연구원·업스테이지·모티프테크놀로지스 등 4개 팀의 최신 모델입니다.</p> <p contents-hash="7b66764a1d2ee91f786c5c8569dfbfac2e4db5083754b5abe8ca133040a5e3ab" dmcf-pid="UD30MFiPNR" dmcf-ptype="general">◆대기업 제친 스타트업</p> <p contents-hash="2724596337d4fdd2a8098cb7ad15331bb4ae569328d3bf3622016e5453480624" dmcf-pid="uw0pR3nQAM" dmcf-ptype="general">결과는 예상 밖이었습니다. 모티프테크놀로지스의 ‘모티프 3’가 47점으로 가장 높았습니다. 업스테이지 ‘솔라 오픈 2’가 37점, SK텔레콤 ‘A.X K2’가 35점, LG AI연구원 ‘K-엑사원 2.0’이 31점으로 뒤를 이었습니다.</p> <p contents-hash="3275b7e31eb022707aff2482362b8813c28aef87a7958da44a55a6b706a999d9" dmcf-pid="7rpUe0Lxax" dmcf-ptype="general">특히 LG AI연구원과 모티프테크놀로지스의 순위가 눈길을 끌었습니다. LG AI연구원은 지난해 12월 독파모 1차 평가에서 NIA·글로벌 공통·글로벌 개별 벤치마크를 합산한 성적에서 1위를 차지했습니다. 반면 모티프테크놀로지스는 독파모 사업 공모에서 정예팀 5개에 선발되지 못했고, ‘패자부활전’을 거쳐 2단계 경쟁에 합류한 팀입니다.</p> <figure class="figure_frm origin_fig" contents-hash="b836c492bb421e4f390b016b6681ec75cb34575ca16d28e3a4e676520995a32b" dmcf-pid="zmUudpoMNQ" dmcf-ptype="figure"> <p class="link_figure"><img alt="미국과 중국, 한국 대표 AI 모델의 AAII 점수. 챗GPT 생성 사진" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/14/segye/20260814162331302ubsb.png" data-org-width="1672" dmcf-mid="ZcQxrPCEgg" dmcf-mtype="image" height="auto" src="https://img4.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/14/segye/20260814162331302ubsb.png" width="658"></p> <figcaption class="txt_caption default_figure"> 미국과 중국, 한국 대표 AI 모델의 AAII 점수. 챗GPT 생성 사진 </figcaption> </figure> <div contents-hash="940359023bb8fb889f80999020a8f74d040064f052f82384bccbee49eb8dc55c" dmcf-pid="qsu7JUgRcP" dmcf-ptype="general"> 정예팀들의 희비를 가른 AAII는 어떤 시험일까요. 현재 사용되는 AAII v4.1.1은 총 9개 세부 시험을 묶어 AI 모델의 능력을 평가합니다. 크게 보면 에이전트 34%, 코딩 24%, 과학적 추론 24%, 일반 능력 18%입니다. 단순히 “이 문제의 답이 뭐냐”고 묻는 시험보다 AI가 여러 단계를 거쳐 스스로 일을 처리하고, 프로그램을 짜고, 도구를 활용해 문제를 해결하는 능력을 중요하게 봅니다. </div> <p contents-hash="bec64a641bee4bbf83b557697dc23e848d208da2a657f2ce703253bcaaf41a19" dmcf-pid="BO7ziuaek6" dmcf-ptype="general">이는 최근 AI 시장의 경쟁 기준이 달라진 영향입니다. 예전에는 어려운 수학 문제를 얼마나 잘 풀고 지식을 얼마나 많이 알고 있는지가 중요했다면, 지금은 AI가 실제 업무를 얼마나 잘 해내는지가 핵심 경쟁력으로 떠오르고 있습니다. 이메일이나 보고서를 작성하는 것에서 더 나아가 자료를 찾고, 프로그램을 실행하고, 필요한 도구를 골라 여러 단계의 업무를 끝까지 수행하는 ‘AI 에이전트’ 능력이 중요해진 겁니다.</p> <p contents-hash="1c0746a6bff871fd495f122d3d457b9f4c69aeeabe8cc1fb721478835c52bc7c" dmcf-pid="bIzqn7Ndc8" dmcf-ptype="general">◆싸움은 체급 순이 아니야</p> <p contents-hash="77ba1385c39eb5d92d221410485e9c832e11cfbac28cee84d957df90ff01e9a2" dmcf-pid="KCqBLzjJj4" dmcf-ptype="general">이번 독파모 2차 평가도 이런 흐름을 반영하고 있습니다. 흥미로운 점은 모델의 덩치와 AAII 점수가 비례하지 않았다는 겁니다. K-엑사원 2.0은 매개변수 약 7500억개(750B)를 가진 초대형 모델입니다. A.X K2도 6880억개 규모입니다. 모티프 3은 3140억개, 솔라 오픈 2는 2500억개 수준입니다.</p> <p contents-hash="ea87ee98f76c29f795f291255d9a2c1aae54ac41a09f7968271390cb8bf64c1f" dmcf-pid="9hBboqAiaf" dmcf-ptype="general">매개변수는 쉽게 말하면 AI가 학습하면서 조정하는 수많은 ‘숫자 값’입니다. 보통 매개변수가 많을수록 더 많은 정보를 담고 복잡한 문제 처리 역량도 커집니다.</p> <p contents-hash="64b7ccd86a85e86d03d1b0196b6594118c422d6056d7ac872e8320f64736a91f" dmcf-pid="2lbKgBcngV" dmcf-ptype="general">LG AI연구원은 이번 개발 과정에서 모델의 체급을 키우는 데 많은 자원을 투입했습니다. 글로벌 최상위권 AI와 장기적으로 경쟁하려면 우선 충분히 큰 ‘그릇’을 만들어야 한다고 판단한 겁니다. 다만 제한된 개발 기간 안에서 모델 대형화와 안정화에 자원이 많이 투입되면서 후학습과 에이전트 성능 최적화에는 상대적으로 시간이 부족했던 것으로 보입니다.</p> <p contents-hash="f1dd7602f3f155eed02c5d62a9049b62c04039702a7474d409474d795d11f47b" dmcf-pid="VSK9abkLa2" dmcf-ptype="general">후학습은 기본 학습을 끝낸 모델을 실제 사용 목적에 맞게 다듬는 과정입니다. 사전학습이 학교에서 여러 과목의 기초를 배우는 과정이라면 실제 서비스에 쓰기 위해 답변 방식을 다듬고, 추론·코딩·도구 사용 능력을 집중적으로 훈련하는 과정이 후학습입니다.</p> <p contents-hash="cfa75a48fe11f111f02b1d55c4e698ac03b246ac248f85dd19d1accad98fad5a" dmcf-pid="fv92NKEoa9" dmcf-ptype="general">물론 이 지표가 각 모델의 최종 경쟁력을 결정하지 않습니다. 여러 평가 지표 중 하나일 뿐이고, 지표 점수가 모델 성능을 보장하는 것도 아닙니다. 한국어 성능과 실제 사용자 경험, 비용, 효율, 안전성, 산업 전문성 등 성능을 결정하는 요소는 다양해서 하나의 지표로 알기 어렵습니다.</p> <figure class="figure_frm origin_fig" contents-hash="b44b9ba7cb9fe3d81fffd6c7c8b70f151ac840b3066753e067009a1dd9cba505" dmcf-pid="4lbKgBcnjK" dmcf-ptype="figure"> <p class="link_figure"><img alt="스타트업 모티프테크놀로지스가 만든 AI 모델이 글로벌 성능 평가에서 LG AI연구원과 SK텔레콤의 대형 AI 모델을 크게 앞섰다. 게티이미지뱅크" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/14/segye/20260814162331530xrii.jpg" data-org-width="800" dmcf-mid="5CNjYa5Tao" dmcf-mtype="image" height="auto" src="https://img2.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/14/segye/20260814162331530xrii.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> 스타트업 모티프테크놀로지스가 만든 AI 모델이 글로벌 성능 평가에서 LG AI연구원과 SK텔레콤의 대형 AI 모델을 크게 앞섰다. 게티이미지뱅크 </figcaption> </figure> <div contents-hash="fa8c3902e208e6029d9630349ef578b0e176f75166dd0f1c4d24b6e577bfca6b" dmcf-pid="8SK9abkLAb" dmcf-ptype="general"> ◆시험 점수 높다고 일 잘하나 </div> <p contents-hash="713822b99ba09b9527c0da8a58087ea4c8655bdda06c8254d5ca49c2e0d11968" dmcf-pid="6v92NKEoAB" dmcf-ptype="general">이번 성적표가 공개되자 또 다른 논쟁이 시작됐습니다. ‘벤치맥싱’입니다.</p> <p contents-hash="84ec01983df8bdc6bd8fd29a86486ba7e3c4cbe9d978bab60d60e3074097b40e" dmcf-pid="PT2Vj9Dgkq" dmcf-ptype="general">벤치맥싱을 쉽게 말하면 AI에게 시험에 잘 나오는 문제를 집중적으로 공부시키는 겁니다. 어떤 벤치마크가 평가에 사용되는지 알고 있다면 그 시험과 비슷한 문제를 대량으로 만들어 모델에 학습시킬 수 있습니다. 실제 범용 능력을 골고루 높이는 것보다 특정 시험의 점수를 빠르게 올리는 데 집중하는 방식입니다.</p> <p contents-hash="a9a3e8853c8d9418ab54dabe79fe633d654ee459fd45fdf7c09f0701c2107abf" dmcf-pid="QyVfA2wagz" dmcf-ptype="general">시험공부를 했다고 무조건 문제라고 볼 수는 없습니다. 코딩 능력을 평가한다면 코딩을 더 많이 훈련하는 건 당연합니다. 문제는 ‘실제 능력이 좋아져서 시험 점수가 오른 것인지, 시험 유형에 지나치게 특화돼 점수만 크게 오른 것인지’ 구분하기 어렵다는 점입니다.</p> <p contents-hash="92290331a1ad11cab45da849abb81ca86edb84516315257bb8b50311b3aa186a" dmcf-pid="xWf4cVrNA7" dmcf-ptype="general">최근에는 이런 벤치마크 성능 개선을 전문적으로 돕는 기업까지 등장했습니다. 미국 AI 학습데이터 기업 애프터쿼리가 대표적입니다. 이 회사는 이미 만들어진 AI 모델을 특정 업무와 에이전트 작업에 잘 맞도록 후학습시키는 데이터셋과 학습 환경을 제공합니다. 주요 AI 벤치마크의 성능을 끌어올린 사례를 소개하기도 합니다.</p> <p contents-hash="cd523aacb7487fc05d7fe2150f0fbfb2b849f3042c3332e6a1309e892496e6b7" dmcf-pid="yMChuIb0au" dmcf-ptype="general">독파모 프로젝트에서는 이미 한 차례 평가 기준을 둘러싼 논쟁이 있었습니다. 1차 평가 당시에는 모델을 처음부터 자체 기술로 만들었는지를 둘러싼 ‘독자성’과 ‘프롬 스크래치(from scratch)’ 논란이 불거졌습니다.</p> <p contents-hash="8d7916d87ca9a2860a7dfb57fc5ab4afc9f4a27cf6480c56b32fe83500b6f3ee" dmcf-pid="WRhl7CKpaU" dmcf-ptype="general">2차 평가에서는 질문이 달라졌습니다. 높은 벤치마크 점수가 AI 모델 성능을 보장하는가. 정부도 이런 한계를 고려해 AAII뿐 아니라 NIA 벤치마크, 전문가 평가와 실제 사용자 평가를 함께 진행합니다.</p> <p contents-hash="832651b289c9452021fbe7deda88feee30d022a459bf23a6a647b9dce2d2c167" dmcf-pid="YelSzh9Uop" dmcf-ptype="general">AI 업계 관계자는 “실제 범용 성능보다 특정 평가 점수를 크게 끌어올릴 방법이 있는 만큼 단일 지표 점수만으로 모델의 종합 성능을 판단하기는 어렵다”며 “한국어 성능과 실사용성, 전문가 평가 등을 종합했을 때 최종 경쟁력이 갈릴 것”이라고 말했습니다.</p> <p contents-hash="8b524556bcd8aa8cd7dac6122822e84e0687bce24155357df8801c85752e1e73" dmcf-pid="GdSvql2uA0" dmcf-ptype="general">정부는 조만간 2차 평가 결과를 발표합니다. 3개 팀만 다음 단계로 진출할 수 있습니다.</p> <p contents-hash="5a907a285fe9aa8febc278ef2300ff723a609bd8126226428f9f72d707a80723" dmcf-pid="HJvTBSV7o3" dmcf-ptype="general">이정한 기자 han@segye.com</p> </section> </div> <p class="" data-translation="true">Copyright © 세계일보. 무단전재 및 재배포 금지.</p>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
놀이터홍보
더보기
[홀덤 홍보]
텍사스홀덤 핸드 순위- 홀카드의 가치
[홀덤 홍보]
텍사스홀덤 핸드 순위 - 프리플랍(Pre-Flop) 핸드 랭킹
[토토 홍보]
미니게임개발제작 전문업체 포유소프트를 추천드립니다.
[토토 홍보]
2023년 일본 만화 판매량 순위 공개
[토토 홍보]
무료만화 사이트 보는곳 3가지 추천
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기