로그인
토토사이트
먹튀사이트/제보
업체홍보/구인
신규사이트
지식/노하우
놀이터홍보
판매의뢰
스포츠분석
뉴스
후기내역공유
커뮤니티
포토
포인트
보증업체
카지노 먹튀
토토 먹튀
먹튀제보
구인
구직
총판
제작업체홍보
카지노
토토
홀덤
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
토토 홍보
카지노 홍보
홀덤 홍보
꽁머니홍보
신규가입머니
제작판매
제작의뢰
게임
축구
야구
농구
배구
하키
미식축구
스포츠뉴스
연예뉴스
IT뉴스
카지노 후기
토토 후기
홀덤 후기
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[]
李, 오늘 메가프로젝트 2차 점검…호남 반도체 '속도전'·상생 확산 논의 (종합)
N
[]
“내가 괜히 국장 돌아와서 고생”…서학개미, 두 달 만에 다시 美주식 순매수
N
[IT뉴스]
[테크데이, 빛으로 通한다]<5>레이저쎌, 대면적 본딩으로 CPO 공략
N
[IT뉴스]
"악성코드 개발·해킹 자동화까지"…北 김수키 AI 해킹 시뮬레이션 정황 포착
N
[스포츠뉴스]
아틀레티코 마드리드 No. 7 이강인의 서울 데뷔전 34분
N
커뮤니티
더보기
[유머★이슈]
바란 은퇴보다 더 소름돋는점
[유머★이슈]
오늘 국군의날 예행연습에 최초 공개된 장비들
[유머★이슈]
손흥민이 한국 병역 시스템에 영향 끼친 것.
[유머★이슈]
시댁의 속터지는 스무고개식 대화법
[유머★이슈]
엄마. 나 여자 임신시켜버렸어
목록
글쓰기
[IT뉴스]UNIST, AI ‘전문가 공유’ 기술 개발…언어모델 크기 63% 줄였다
온카뱅크관리자
조회:
12
2026-08-10 08:47:32
<div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">각 신경망 층에 공용 모듈 적용해 매개변수 중복 최소화<br>이전 선택 점수 넘겨받아 특정 경로 쏠림 현상도 해결<br>성능은 기존 수준 유지…온디바이스 AI 등 적용 기대</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="p3XN0vTsSC"> <figure class="figure_frm origin_fig" contents-hash="db09255c0073e8a7084a5a883698094ef61f963cb0cfaa5cb459de978097cfa7" dmcf-pid="U0ZjpTyOyI" dmcf-ptype="figure"> <p class="link_figure"><img alt="모든 신경망층이 함께 쓰는 공용 전문가와 해당 층에만 있는 전용 전문가를 혼합하는 기술의 모식도. 연구그림=UNIST" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/10/seouleconomy/20260810084129515gwzd.png" data-org-width="1200" dmcf-mid="0zleGrmjhh" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/10/seouleconomy/20260810084129515gwzd.png" width="658"></p> <figcaption class="txt_caption default_figure"> 모든 신경망층이 함께 쓰는 공용 전문가와 해당 층에만 있는 전용 전문가를 혼합하는 기술의 모식도. 연구그림=UNIST </figcaption> </figure> <p contents-hash="42c6097d8a0020267a8bd15c919aca2e289556cbba13040fe2f7315ab2d93bfb" dmcf-pid="u7FEzGHlvO" dmcf-ptype="general">챗GPT 등 대형언어모델(LLM)의 효율을 높이는 새로운 신경망 구조가 나왔다. 매개변수(파라미터)를 대폭 줄이면서 성능은 그대로 유지한다.</p> <p contents-hash="605a5d36e49ef248faceb5a21aaf65df9cfca0476094b8288a130b1d0a205e5e" dmcf-pid="7z3DqHXSys" dmcf-ptype="general">울산과학기술원(UNIST) 인공지능대학원 김태환 교수팀은 여러 신경망 층이 인공지능 모듈을 공유하는 새로운 전문가 혼합 구조 ‘GMoE(Global Mixture of Experts)’를 개발했다고 10일 밝혔다. 기존 언어모델의 메모리 부족과 연산 비효율을 동시에 해결한 기술이다.</p> <p contents-hash="730478f1df6b4b34142b451e61ef3941d0f6718db8650be4cc7664439aca3795" dmcf-pid="zq0wBXZvhm" dmcf-ptype="general">대형언어모델은 여러 전문가 모듈 중 일부만 골라 쓰는 ‘전문가 혼합(MoE)’ 방식을 주로 쓴다. 기존 모델은 각 신경망 층마다 별도의 전문가 집단을 뒀다. 층이 깊어질수록 매개변수가 기하급수적으로 늘어났다. 비슷한 기능이 중복되는 문제도 컸다.</p> <p contents-hash="dd27b9e2dd568b7c77653e038759049eaf191e8035d89afc0f50dc4d0b7d0b59" dmcf-pid="qBprbZ5Tvr" dmcf-ptype="general">연구팀은 ‘공유’로 문제를 풀었다. GMoE는 모든 신경망 층이 함께 쓰는 ‘공용 전문가’와 각 층에 하나씩 두는 ‘전용 전문가’로 구성된다. 가령 100개 층에 전문가를 1000명씩 두면 총 10만 명이 필요하다. 반면 GMoE는 각 층 전용 전문가 100명에 공용 전문가 1000명만 추가해 1100명으로 전체 구조를 짠다. 모델 크기와 필요 메모리가 크게 줄어든다.</p> <p contents-hash="2fb88e9e443612d70e7b3627672f39fab43d270ec6d0f1999a0ff1f8d18a13e3" dmcf-pid="BbUmK51yyw" dmcf-ptype="general">실제 성능 평가에서도 효율이 입증됐다. 연구팀은 독해, 문법, 상식 추론 등 7개 분야를 시험했다. 중간 크기 모델 기준 매개변수를 5억 4900만 개에서 2억 400만 개로 약 63% 줄였다. 평균 정답률은 39.51%를 기록했다. 매개변수가 2.5배가량 많은 기존 모델(39.55%)과 맞먹는 수치다.</p> <p contents-hash="1049bf10c8b7a3875713565efd6fc9d367661e64778bdac5523d3e3691648d57" dmcf-pid="bKus91tWWD" dmcf-ptype="general">입력값이 특정 전문가에게만 쏠리는 고질적 문제도 해결했다. GMoE는 앞선 층의 라우터 계산 점수를 다음 층으로 넘긴다. 이전 선택을 참고해 전문가를 고르게 분배한다. 그 결과 기존 방식보다 3배 이상 많은 8만 1561개의 경로를 활용했다. 가장 많이 쓰인 단일 경로 쏠림 비중도 기존 25.65∼45.55%에서 11.15%로 떨어졌다. 제한된 용량을 구석구석 알차게 활용한다는 의미다.</p> <p contents-hash="47ee3283dfd913658168fc91578186c402d465f69cd1176445839f471a01e1fc" dmcf-pid="K97O2tFYSE" dmcf-ptype="general">이번 연구는 홍건우 석사과정생이 제1저자로 참여했다. 연구 성과는 자연어 처리 분야 최고 권위 국제학회인 ‘ACL 2026’에 게재됐다. 관련 코드는 깃허브 프로젝트 페이지에 공개했다.</p> <p contents-hash="340cc40a86962019d06985c93702cbf205f6b9e835101b84c4b1568af68fb16b" dmcf-pid="92zIVF3Glk" dmcf-ptype="general">김태환 교수는 “기존 전문가 혼합 모델은 서로 다른 신경망 층이 비슷한 기능을 반복해서 학습하고, 각 층 안에서도 일부 전문가만 주로 활용되는 ‘복합 중복성’ 문제가 있었다”며 “이번 연구는 이러한 문제를 하나의 구조 안에서 함께 완화하는 새로운 아키텍처를 제시한 연구”라고 설명했다. 이어 “대형 언어모델이 더 적은 매개변수로도 다양한 전문가 조합을 활용하고, 같은 크기에서도 더 많은 방식으로 입력을 처리하는 데 기여할 것”이라고 말했다.</p> <p contents-hash="0f04b8e5b0e8db89803666d79b31723132dfc7b979795cbacf3aad68aed9a13f" dmcf-pid="2VqCf30Hlc" dmcf-ptype="general">울산=장지승 기자 jjs@sedaily.com</p> </section> </div> <p class="" data-translation="true">Copyright © 서울경제. 무단전재 및 재배포 금지.</p>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
놀이터홍보
더보기
[홀덤 홍보]
텍사스홀덤 핸드 순위- 홀카드의 가치
[홀덤 홍보]
텍사스홀덤 핸드 순위 - 프리플랍(Pre-Flop) 핸드 랭킹
[토토 홍보]
미니게임개발제작 전문업체 포유소프트를 추천드립니다.
[토토 홍보]
2023년 일본 만화 판매량 순위 공개
[토토 홍보]
무료만화 사이트 보는곳 3가지 추천
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기