로그인
보증업체
신규사이트
스포츠분석
먹튀사이트/제보
지식/노하우
놀이터홍보
판매의뢰
업체홍보/구인
뉴스
후기내역공유
커뮤니티
포토
포인트
보증카지노
보증토토
카지노
토토
홀덤
축구
야구
농구
배구
하키
미식축구
카지노 먹튀
토토 먹튀
먹튀제보
카지노 노하우
토토 노하우
홀덤 노하우
기타 지식/노하우
유용한 사이트
토토 홍보
카지노 홍보
홀덤 홍보
꽁머니홍보
신규가입머니
제작판매
제작의뢰
게임
구인
구직
총판
제작업체홍보
스포츠뉴스
연예뉴스
IT뉴스
카지노 후기
토토 후기
홀덤 후기
자유게시판
유머★이슈
동영상
연예인
섹시bj
안구정화
출석하기
포인트 랭킹
포인트 마켓
로그인
자동로그인
회원가입
정보찾기
뉴스
더보기
[연예뉴스]
유재석, 이준영 뜻밖의 모습에 "기가 막혀"
N
[]
유엔의 對이란제재 복원 '초읽기' 돌입…협상여지는 남아(종합)
N
[연예뉴스]
‘특파원보고 세계는 지금’ 트럼프, ‘시카고의 종말’ 예고? ‘불체자’ 단속용 주 방위군 배치로 긴장 심화
N
[IT뉴스]
[2025 버육대 1일차] 창던지기 말왕, 황금쌀먹단 양궁 金
N
[IT뉴스]
"요즘 누가 '포토샵' 써요" 이런 사람들 많더니···시총 94조 날아간 '이 회사', 어디?
N
커뮤니티
더보기
[유머★이슈]
바란 은퇴보다 더 소름돋는점
[유머★이슈]
오늘 국군의날 예행연습에 최초 공개된 장비들
[유머★이슈]
손흥민이 한국 병역 시스템에 영향 끼친 것.
[유머★이슈]
시댁의 속터지는 스무고개식 대화법
[유머★이슈]
엄마. 나 여자 임신시켜버렸어
제휴문의 텔레그램 @dognus11
목록
글쓰기
[IT뉴스]생성형 AI, 지능 평가했더니…1등은 'IQ 130', 누구?
온카뱅크관리자
조회:
53
2025-04-01 17:07:32
<div id="layerTranslateNotice" style="display:none;"></div> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="xHbTZY8tkz"> <p contents-hash="49a2081205964334e359328cfb759a058a9d3cc7e36790b1325ff1cdf77fc1cd" dmcf-pid="yME8eQIic7" dmcf-ptype="general">(지디넷코리아=AI 에디터 )</p> <figure class="figure_frm origin_fig" contents-hash="7058fd44a204d7231f574bf62c9367a9107390dca2016b5368b4f7764c09c346" dmcf-pid="WRD6dxCncu" dmcf-ptype="figure"> <p class="link_figure"><img class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202504/01/ZDNetKorea/20250401165931728vpen.jpg" data-org-width="640" dmcf-mid="ZQIq5G6Fj9" dmcf-mtype="image" height="auto" src="https://img4.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202504/01/ZDNetKorea/20250401165931728vpen.jpg" width="658"></p> </figure> <p contents-hash="1da5083eaeaab3ac85ce5b8a82e824b7296c017cbaefe482b4cd8d86d607ab4b" dmcf-pid="YewPJMhLjU" dmcf-ptype="general"><strong>구글 제미나이 2.5 프로, IQ 130으로 AI 모델 중 최고 지능 입증</strong></p> <p contents-hash="612698323e0274de4faffac3bfc663eeb6ad6b7bfec7872450559d5d1e7000c2" dmcf-pid="GdrQiRloap" dmcf-ptype="general">생성형 AI 기술이 빠르게 발전하면서 각 모델의 성능을 객관적으로 평가하는 지표의 중요성이 커지고 있다. 'Tracking AI'는 최근 17개의 텍스트 기반 AI 모델과 6개의 비전 기반 AI 모델을 대상으로 IQ 테스트를 실시했다. 특히 주목할 만한 결과는 구글(Google)의 제미나이 2.5 프로(Gemini 2.5 Pro Exp.)가 멘사 노르웨이(Mensa Norway) 테스트에서 IQ 130점을 기록하며 전체 AI 모델 중 가장 높은 점수를 획득했다는 점이다. 이는 일반적으로 인간의 '매우 우수한' 지능 수준으로 평가되는 점수로, AI가 인간 수준의 인지 능력에 근접하고 있음을 시사한다.</p> <p contents-hash="e6e80a76036062df71ad707a98fd9201678719f5ccb366164ca58a74d6a0b008" dmcf-pid="HJmxneSgA0" dmcf-ptype="general">오프라인 테스트에서는 오픈AI(OpenAI)의 o1 프로(o1 Pro)와 o1 모델이 각각 120점과 125점으로 높은 점수를 기록했다. 앤트로픽(Anthropic)의 클로드 3.7 소넷 익스텐디드(Claude 3.7 Sonnet Extended)도 멘사 노르웨이 테스트에서 107점, 오프라인 테스트에서 118점을 기록하며 상위권에 위치했다.</p> <figure class="figure_frm origin_fig" contents-hash="4b3f7be82955a21f2d01f5a8820c4a5ade53264ddfecddb17f73655ca5e42ab0" dmcf-pid="XisMLdvaA3" dmcf-ptype="figure"> <p class="link_figure"><img class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202504/01/ZDNetKorea/20250401165933145tmnk.jpg" data-org-width="637" dmcf-mid="5dUB1HP3kK" dmcf-mtype="image" height="auto" src="https://img3.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202504/01/ZDNetKorea/20250401165933145tmnk.jpg" width="658"></p> </figure> <p contents-hash="4070f35847260f2dbe33c9c2972f3e1b3be7cfa07dcba2842529697e189c4255" dmcf-pid="ZnORoJTNjF" dmcf-ptype="general"><strong>오픈AI와 앤트로픽의 경쟁: 상위 10개 AI 모델 중 7개가 오픈AI 제품</strong></p> <p contents-hash="266549a1885da6b60eb9396f90128b350ee352fdfaeaa6ee2dec9f3c0462d13c" dmcf-pid="5LIegiyjkt" dmcf-ptype="general">테스트 결과를 자세히 살펴보면, 전체 순위에서 상위 10개 모델 중 7개가 오픈AI의 제품이라는 점이 특히 주목할 만하다. 오픈AI의 o1 프로, o3 미니, GPT-4.5 프리뷰, o1, o3 미니 하이, o1 프로(비전), o1(비전) 모델이 모두 상위권에 위치했다. 이는 오픈AI가 다양한 유형의 AI 모델 개발에서 선두를 달리고 있음을 보여준다.</p> <p contents-hash="fc0be09b81def55471887d02df4fbf2ffd15876118ebd93b0c9bdbc78e7fc81d" dmcf-pid="1oCdanWAj1" dmcf-ptype="general">앤트로픽은 클로드 3.7 소넷 익스텐디드와 클로드 3.7(비전) 모델이 각각 3위와 9위를 차지하며 오픈AI와의 경쟁에서 선전했다. 특히 클로드 3.7 소넷 익스텐디드는 오프라인 테스트에서 118점을 기록하며 높은 성능을 보였다.</p> <p contents-hash="9e0135688cb1b28b78a87c97eb5032fdef77f91bdb056f9229133ece6e0e1a8a" dmcf-pid="tghJNLYcg5" dmcf-ptype="general">한편, 딥시크(DeepSeek)의 R1과 V3 모델은 각각 16위와 18위를 차지했으며, xAI의 그록-3(Grok-3)과 그록-3 씽크(Grok-3 Think)는 19위와 14위를 기록했다. 메타(Meta)의 라마-3.3(Llama-3.3)과 라마-3.2(비전)(Llama-3.2 Vision)은 하위권에 머물렀다.</p> <p contents-hash="7c1f09ba3f0f5feecb2443b4b243fbbb7c7ec4364e8bf0f9ead445011179d3c6" dmcf-pid="FalijoGkjZ" dmcf-ptype="general"><strong>텍스트 vs 비전: AI 모델의 도메인별 성능 차이 분석</strong></p> <p contents-hash="868853017793d59afcbe6a38d411a405e1b8b4a74db67176e5ca753b8d98d2e2" dmcf-pid="3NSnAgHEoX" dmcf-ptype="general">테스트 결과를 통해 텍스트 기반 모델과 비전 기반 모델 간의 성능 차이도 확인할 수 있었다. 흥미로운 점은 동일한 AI 모델이라도 텍스트 처리와 이미지 처리 능력에서 상당한 차이를 보인다는 것이다. 예를 들어, GPT-4o는 텍스트 버전에서 멘사 노르웨이 테스트 94점, 오프라인 테스트 65점을 기록한 반면, 비전 버전에서는 각각 67점과 67점을 기록했다. 이는 동일한 모델이라도 도메인에 따라 성능이 크게 달라질 수 있음을 보여준다.</p> <p contents-hash="82742fb59dcf14bb6490fa48639fc3b9d67629bd45a192e1a5fe0a399ef7630b" dmcf-pid="0EYNwctskH" dmcf-ptype="general">반면 오픈AI의 o1 프로는 텍스트 버전(멘사 노르웨이 110점, 오프라인 120점)과 비전 버전(멘사 노르웨이 87점, 오프라인 95점) 모두에서 상대적으로 균형 잡힌 성능을 보여주었다. 이는 멀티모달 AI 모델의 발전 방향을 시사한다.</p> <p contents-hash="520690971b4af94f51bb0155e48b8523b16cc33a2acd6c5b93dc531f39b8de85" dmcf-pid="pDGjrkFOoG" dmcf-ptype="general"><strong>생각하는 AI의 부상: 플래시 씽킹과 확장된 추론 기능의 효과</strong></p> <p contents-hash="5ec2cf843c9bc2414d3ef6b7180a7aff46e8c78491fb209c988ebfebae8a0ee5" dmcf-pid="UwHAmE3IAY" dmcf-ptype="general">최근 AI 개발 트렌드 중 하나는 '생각하는(thinking)' 기능을 갖춘 모델의 등장이다. 구글의 제미나이 2.0 플래시 씽킹(Gemini 2.0 Flash Thinking Exp.)과 xAI의 그록-3 씽크(Grok-3 Think)가 이러한 추세를 대표한다. 테스트 결과, 제미나이 2.0 플래시 씽킹은 멘사 노르웨이 테스트에서 84점, 오프라인 테스트에서 111점을 기록했다. 또한 그록-3 씽크는 멘사 노르웨이 테스트에서 86점, 오프라인 테스트에서 108점을 획득했다. 이는 표준 모델보다 더 복잡한 추론을 수행할 수 있는 '확장된 사고' 기능이 실제로 AI의 문제 해결 능력을 향상시킬 수 있음을 보여준다.</p> <p contents-hash="438227c114c49380c5921fbe821f55c5ed46a6209717e848a8d433b383e973e2" dmcf-pid="urXcsD0CcW" dmcf-ptype="general">클로드 3.7 소넷 익스텐디드 역시 '확장된(Extended)' 버전으로, 기본 모델보다 더 긴 시간 동안 복잡한 추론을 수행할 수 있는 능력을 갖추고 있다. 이 모델이 상위권에 위치한 것은 AI의 '사고 시간'이 성능 향상에 중요한 요소임을 시사한다.</p> <p contents-hash="fbf19c48e814a7edde5c6fd46ef116cd3a58993b5239d5645c6730f04c9e6026" dmcf-pid="7mZkOwphky" dmcf-ptype="general"><strong>FAQ</strong></p> <p contents-hash="5ecc5b7a8c3e0e7bdec93b594beb1f868f6df8c00946fd983b60a25f438ef9d5" dmcf-pid="zs5EIrUljT" dmcf-ptype="general"><strong>Q: IQ 테스트가 AI의 실제 능력을 측정하는 데 적합한 방법인가요?</strong></p> <p contents-hash="8c2dff0b3dc806cb9b04d7dcd38df8e8c7068f1bf1ca3a2d411e90f389f88589" dmcf-pid="qO1DCmuScv" dmcf-ptype="general">A: IQ 테스트는 패턴 인식, 논리적 추론 등 특정 인지 능력을 측정하는 데 유용합니다. 그러나 AI의 전반적인 능력을 평가하기 위해서는 다양한 벤치마크와 실제 응용 사례를 함께 고려해야 합니다. Tracking AI의 테스트는 AI 모델 간의 상대적 성능을 비교하는 하나의 지표로 활용될 수 있습니다.</p> <p contents-hash="5bbac8d178d24985e1f1bab36468e40ce6996e081d477c8689ac703299ede2a9" dmcf-pid="BItwhs7vjS" dmcf-ptype="general"><strong>Q: 가장 높은 IQ 점수를 받은 AI 모델이 실제 사용에서도 가장 우수한가요?</strong></p> <p contents-hash="5ef04eeebde4cf3a2996d2418924aac6ce0f9048a85cbc6a9be5ca8ea2746771" dmcf-pid="bCFrlOzTkl" dmcf-ptype="general">A: 반드시 그렇지는 않습니다. IQ 테스트는 특정 유형의 문제 해결 능력을 측정하지만, 실제 사용에서는 문맥 이해, 사용자 의도 파악, 안전성, 편향성 등 다양한 요소가 중요합니다. 따라서 특정 사용 사례에 가장 적합한 모델은 IQ 점수만으로 결정할 수 없습니다.</p> <p contents-hash="e94c4949c5c7fc16f4f0f351766ffdc9d9f2e44dcc79997dd77b847762810884" dmcf-pid="Kh3mSIqyoh" dmcf-ptype="general"><strong>Q: 일반 사용자가 이러한 AI 모델들을 어떻게 이용할 수 있나요?</strong></p> <p contents-hash="7837c41341cc7d78defccb6fe35a0e6e79a481b82cf56d6f59c11c8300c09c92" dmcf-pid="9l0svCBWaC" dmcf-ptype="general">A: 대부분의 주요 AI 모델은 웹 인터페이스나 API를 통해 접근할 수 있습니다. OpenAI의 ChatGPT, 앤트로픽의 Claude, 구글의 Gemini 등은 일반 사용자를 위한 서비스를 제공하고 있으며, 일부는 무료 버전도 제공합니다. 기업용으로는 API를 통한 통합 옵션도 있습니다.</p> <p contents-hash="c1208b8a15fc8e9f86886eda3ff50f8c0de4ce2988b7ac8f1fea7892feda51e2" dmcf-pid="2SpOThbYkI" dmcf-ptype="general">■ 이 기사는 AI 전문 매체 ‘<span>AI 매터스</span>’와 제휴를 통해 제공됩니다. 기사는 클로드 3.5 소네트와 챗GPT를 활용해 작성되었습니다. </p> <p contents-hash="e90d65b1a4b5729c3cf47a8c630d9883590070da2381932568885e144a315df9" dmcf-pid="VvUIylKGaO" dmcf-ptype="general">AI 에디터 (media@zdnet.co.kr)</p> </section> </div> <p class="" data-translation="true">Copyright © 지디넷코리아. 무단전재 및 재배포 금지.</p>
댓글등록
댓글 총
0
개
맨위로
이번주
포인트
랭킹
매주 일요일 밤 0시에 랭킹을 초기화합니다.
1
4,000
상품권
2
3,000
상품권
3
2,000
상품권
업체홍보/구인
더보기
[구인]
유투브 BJ 구인중이자나!완전 럭키비키자나!
[구인]
에카벳에서 최대 조건으로 부본사 및 회원님들 모집합니다
[구인]
카지노 1번 총판 코드 내립니다.
[구인]
어느날 부본사 총판 파트너 모집합니다.
[구인]
고액전용 카지노 / 헬렌카지노 파트너 개인 팀 단위 모집중 최고우대
놀이터홍보
더보기
[홀덤 홍보]
텍사스홀덤 핸드 순위- 홀카드의 가치
[홀덤 홍보]
텍사스홀덤 핸드 순위 - 프리플랍(Pre-Flop) 핸드 랭킹
[토토 홍보]
미니게임개발제작 전문업체 포유소프트를 추천드립니다.
[토토 홍보]
2023년 일본 만화 판매량 순위 공개
[토토 홍보]
무료만화 사이트 보는곳 3가지 추천
지식/노하우
더보기
[카지노 노하우]
혜택 트렌드 변화 위험성 다시 가늠해 보기
[카지노 노하우]
호기심이 부른 화 종목 선택의 중요성
[카지노 노하우]
카지노 블랙잭 카드 조합으로 히트와 스탠드를 결정하는 방법
[카지노 노하우]
흥부가 놀부될때까지 7
[카지노 노하우]
5월 마틴하면서 느낀점
판매의뢰
더보기
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
[제작판매]
html5웹미니게임제작 해시게임제작 카드포커게임제작 스포츠토토 카지노 슬롯 에볼루션 토지노 솔루션분양임대재작
포토
더보기
채팅하기