로그인
토토사이트
먹튀사이트/제보
업체홍보/구인
신규사이트
지식/노하우
놀이터홍보
판매의뢰
스포츠분석
뉴스
후기내역공유
커뮤니티
포토
포인트
보증업체
카지노 먹튀
토토 먹튀
먹튀제보
구인
구직
총판
제작업체홍보
카지노
토토
홀덤
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
토토 홍보
카지노 홍보
홀덤 홍보
꽁머니홍보
신규가입머니
제작판매
제작의뢰
게임
축구
야구
농구
배구
하키
미식축구
스포츠뉴스
연예뉴스
IT뉴스
카지노 후기
토토 후기
홀덤 후기
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[]
인사수석 신설 무색…용혜인 사퇴에 靑 ‘정무 판단’ 도마
N
[IT뉴스]
달 사진 들이대면 AI가 알아서 분석…‘생명수’ 얻을 얼음 분포지 찍어준다
N
[IT뉴스]
시진핑 "AI 개방·협력·공유해야"…브릭스서 中 주도권 메시지
N
[IT뉴스]
위메이드 경영권 매각...네오펄스-킹넷 컨소시엄 "10월 30일 거래 종결 목표"
N
[IT뉴스]
[AI 고속도로] 공무원 AI도 국산 NPU로…범정부 인프라 다변화 속도
N
커뮤니티
더보기
[유머★이슈]
바란 은퇴보다 더 소름돋는점
[유머★이슈]
오늘 국군의날 예행연습에 최초 공개된 장비들
[유머★이슈]
손흥민이 한국 병역 시스템에 영향 끼친 것.
[유머★이슈]
시댁의 속터지는 스무고개식 대화법
[유머★이슈]
엄마. 나 여자 임신시켜버렸어
목록
글쓰기
[IT뉴스]"챗GPT-5.2 이미지 가역성, 사람 절반 수준"
온카뱅크관리자
조회:
6
2026-09-14 11:57:25
<div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">GIST, C3-벤치 개발 AI 정확성 등 평가해보니…"문장 자연스러움은 더 우수"</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="pcgEHCEoaq"> <p contents-hash="5a2d4e05aadf4efb158ff3d6ada44af51b9965b1a599a35cc0e7ae20a3f5bea5" dmcf-pid="UkaDXhDgAz" dmcf-ptype="general">(지디넷코리아=박희범 기자)<span>인공지능(AI)이 제대로 답을 찾았는지를 평가하는 벤치마크가 개발됐다. 챗 GPT를 사람과 비교했을 때 가역성(역으로 뒤집어 보는) 평가에서는 절반 수준에 불과한 것으로 나타났다.</span></p> <p contents-hash="9273f6869fbe73c76843a0e23a867e16aa61d7b272e3385b3af303d814f7b39e" dmcf-pid="uDjr5SrNA7" dmcf-ptype="general">광주과학기술원(GIST)은 김의환 AI학과 교수 연구팀이 두 장의 이미지를 비교해 인공지능(AI)이 주어진 상황에 맞는 중요한 변화를 찾아 정확하게 설명하는지 확인할 수 있는 새로운 평가 기준 ‘C3-벤치(문맥 인식 변화 설명 평가체계)’를 개발, 시험한 결과를 14일 공개했다.</p> <figure class="figure_frm origin_fig" contents-hash="21119f377fc2abb0798e500dced05998c645ff25eebb868d1e34a3520b5f6739" dmcf-pid="7wAm1vmjgu" dmcf-ptype="figure"> <p class="link_figure"><img alt="C3-벤치 개요(위)와 GPT-5.2 대표 오류사례.(그림=GIST)" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/14/ZDNetKorea/20260914115150804pfmg.jpg" data-org-width="639" dmcf-mid="4yZhpGhDci" dmcf-mtype="image" height="auto" src="https://img3.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/14/ZDNetKorea/20260914115150804pfmg.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> C3-벤치 개요(위)와 GPT-5.2 대표 오류사례.(그림=GIST) </figcaption> </figure> <p contents-hash="c38679b3742649042675e3f7f75ccf75ab79405d168e4203ad7c8dc2b5cab4bc" dmcf-pid="zrcstTsAgU" dmcf-ptype="general">'C3-벤치'는 두 장의 이미지 비교에서 ‘무엇을 살펴볼 것인지’를 제시하고, AI가 그 목적에 맞는 변화를 골라 설명하는지 확인하는 일종의 ‘AI 변화 이해력 시험’이다.</p> <p contents-hash="76f589933974721ddfb3c92a9cf8ba1e19c88c808fa14666525be6bdd7d8d728" dmcf-pid="qmkOFyOcgp" dmcf-ptype="general">예를들어 같은 철도 사진 두 장이라도 날씨 변화를 살피는 상황에서는 눈이 쌓이거나 구름이 줄어든 것이 중요한 변화가 될 수 있다. 반면 철도 안전을 확인하는 상황에서는 선로에 새로 나타난 열차가 핵심적인 변화이고, 날씨 차이는 중요하지 않을 수 있다.</p> <p contents-hash="be82d6c1ad512a15dbbce2ecda52ce70b9e8b527b611effef34d04015f93eb82" dmcf-pid="BsEI3WIkN0" dmcf-ptype="general">그러나 기존 평가용 데이터는 특정 장면이나 변화에 집중돼 있거나, 각 상황에서 어떤 변화를 중요하게 봐야 하는지가 명확하게 정해져 있지 않은 경우가 많다.</p> <p contents-hash="95fa838148204a5683c32626387fc111cfc9f5f2a76176db504ca30770da9d00" dmcf-pid="bODC0YCEc3" dmcf-ptype="general">연구팀은 이러한 한계를 보완하기 위해 ▲자연 장면 ▲위성·항공 등 원격탐사 영상 ▲이미지 편집 ▲이상 탐지 등 4개 분야에서 51개의 현실적인 변화 상황을 선정하고, 사람이 변화 내용을 직접 설명한 4,996개의 이미지 쌍으로 'C3-벤치'를 구성했다.</p> <p contents-hash="f87ecd005071ab008506f6ae9970eb5155fbb67dd97e22476569ad0920e67201" dmcf-pid="KIwhpGhDoF" dmcf-ptype="general">논문 제1저자인 김재우 AI학과 석·박사통합과정생은 "각 상황마다 AI가 ‘찾아야 할 변화’와 ‘무시해야 할 차이’, ‘변화를 설명할 때 지켜야 할 기준’을 구체적으로 정했다"고 설명했다.</p> <p contents-hash="5e00077d1f89459babe138038a6445186648b471cc9eb8b10088697952cd3aaf" dmcf-pid="9CrlUHlwot" dmcf-ptype="general">연구팀은 AI가 내놓은 답을 평가하는 방식도 기존과 달리했다. 정답 문장과 같은 단어가 얼마나 포함됐는지만 비교하는 대신, ▲내용이 정확한지 ▲변화를 구체적으로 설명했는지 ▲문장이 자연스러운지 ▲주어진 상황에 맞는 내용인지를 함께 살펴 답변의 의미를 종합적으로 평가했다.</p> <p contents-hash="b718e734a90212f0f40a8fa8bbda652c621775140b50deba373087863c746d5b" dmcf-pid="2hmSuXSrA1" dmcf-ptype="general">400개의 이미지 쌍을 대상으로 사람과 GPT-5.2가 각각 이미지 속 변화를 설명하도록 하고, 답변의 정확성·구체성·자연스러움·상황 관련성을 비교한 결과 4개 항목을 종합한 10점 만점 점수는 사람이 7.45점, GPT-5.2가 5.72점으로 1.73점의 차이를 보였다.</p> <figure class="figure_frm origin_fig" contents-hash="bb48f0e1d08c9065631e3bb9a99b1f5ac553cb058e19e33b43aab7393b38a96d" dmcf-pid="Vlsv7ZvmA5" dmcf-ptype="figure"> <p class="link_figure"><img alt="GIST 연구팀. 왼쪽부터 김의환 AI학과 교수, 김재우 석·박사통합과정생.(사딘=GIST)" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202609/14/ZDNetKorea/20260914115152038dosw.jpg" data-org-width="400" dmcf-mid="6n9PkiPKAd" dmcf-mtype="image" height="auto" src="https://img1.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202609/14/ZDNetKorea/20260914115152038dosw.jpg" width="658"></p> <figcaption class="txt_caption default_figure"> GIST 연구팀. 왼쪽부터 김의환 AI학과 교수, 김재우 석·박사통합과정생.(사딘=GIST) </figcaption> </figure> <p contents-hash="5fee16054025af15b42099bbe5b40e985ae1f609c12861b5eb6979e36783f44e" dmcf-pid="fSOTz5TsNZ" dmcf-ptype="general">반면 문장의 자연스러움만 놓고 보면 GPT-5.2가 8.53점으로 사람(8.32점)보다 오히려 높았다.</p> <p contents-hash="c14716cddc389f753f712343684215c2eedcb34dd5c9dd0e01c6083e3acca893" dmcf-pid="4vIyq1yONX" dmcf-ptype="general">김재우 석·박사통합과정생은 "AI가 사람이 쓴 글에 가까운 자연스러운 문장을 만드는 능력과 실제 이미지에서 중요한 변화를 정확하게 찾아내는 능력이 반드시 같은 것은 아님을 보여준다"고 부연 설명했다.</p> <p contents-hash="883d0811c93cf6998abe8da71618e1c545d1202b8ec232214eb409c687518890" dmcf-pid="8TCWBtWIjH" dmcf-ptype="general">연구팀은 또 이미지의 순서를 바꿨을 때도 같은 변화를 앞뒤에 맞게 설명하는지를 확인했다. 예를 들어 첫 번째 사진에서 “물체가 새로 생겼다”고 설명했다면, 사진의 순서를 뒤집었을 때는 같은 물체가 “사라졌다”고 설명해야 한다.</p> <p contents-hash="3df253b5faa689204e2ce61f04b975c6ea9c4737c86f734adb2d89484331f6e3" dmcf-pid="6yhYbFYCkG" dmcf-ptype="general">연구팀은 이러한 능력을 ‘가역성’으로 평가했다. 그 결과 사람은 93%의 가역성 점수를 보인 반면 GPT-5.2는 61%에 그쳤다. 이는 최신 AI가 자연스러운 문장을 만드는 데는 뛰어나지만, 사진 속 변화의 방향까지 일관되게 이해하는 데는 여전히 한계가 있음을 보여준다.</p> <p contents-hash="67324c2338caf82753a75099ab5eb2eec234d994f57c4641c42210e4748e5008" dmcf-pid="PmkOFyOcAY" dmcf-ptype="general">한편 연구결과는 지난 12일까지 스웨덴 말뫼에서 열린 국제학술대회 ‘ECCV 2026’에 채택됐다. 'ECCV'는 유럽컴퓨터비전협회(ECVA)가 주관하는 컴퓨터비전·머신러닝 분야의 주요 국제학술대회다.</p> <p contents-hash="93dbab5bb9ddc6a21f9cf2718f5a101f58f24905fea162678f2c4c6de0887824" dmcf-pid="QsEI3WIkjW" dmcf-ptype="general">박희범 기자(hbpark@zdnet.co.kr)</p> </section> </div> <p class="" data-translation="true">Copyright © 지디넷코리아. 무단전재 및 재배포 금지.</p>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
놀이터홍보
더보기
[홀덤 홍보]
텍사스홀덤 핸드 순위- 홀카드의 가치
[홀덤 홍보]
텍사스홀덤 핸드 순위 - 프리플랍(Pre-Flop) 핸드 랭킹
[토토 홍보]
미니게임개발제작 전문업체 포유소프트를 추천드립니다.
[토토 홍보]
2023년 일본 만화 판매량 순위 공개
[토토 홍보]
무료만화 사이트 보는곳 3가지 추천
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기