AI 모델 IQ 테스트 결과는? 구글 제미나이 2.5 프로, IQ 130으로 1등 : 다나와 DPG는 내맘을 디피지

구글 제미나이 2.5 프로, IQ 130으로 AI 모델 중 최고 지능 입증

생성형 AI 기술이 빠르게 발전하면서 각 모델의 성능을 객관적으로 평가하는 지표의 중요성이 커지고 있다. 'Tracking AI'는 최근 17개의 텍스트 기반 AI 모델과 6개의 비전 기반 AI 모델을 대상으로 IQ 테스트를 실시했다. 특히 주목할 만한 결과는 구글(Google)의 제미나이 2.5 프로(Gemini 2.5 Pro Exp.)가 멘사 노르웨이(Mensa Norway) 테스트에서 IQ 130점을 기록하며 전체 AI 모델 중 가장 높은 점수를 획득했다는 점이다. 이는 일반적으로 인간의 '매우 우수한' 지능 수준으로 평가되는 점수로, AI가 인간 수준의 인지 능력에 근접하고 있음을 시사한다.

오프라인 테스트에서는 오픈AI(OpenAI)의 o1 프로(o1 Pro)와 o1 모델이 각각 120점과 125점으로 높은 점수를 기록했다. 앤트로픽(Anthropic)의 클로드 3.7 소넷 익스텐디드(Claude 3.7 Sonnet Extended)도 멘사 노르웨이 테스트에서 107점, 오프라인 테스트에서 118점을 기록하며 상위권에 위치했다.

오픈AI와 앤트로픽의 경쟁: 상위 10개 AI 모델 중 7개가 오픈AI 제품

테스트 결과를 자세히 살펴보면, 전체 순위에서 상위 10개 모델 중 7개가 오픈AI의 제품이라는 점이 특히 주목할 만하다. 오픈AI의 o1 프로, o3 미니, GPT-4.5 프리뷰, o1, o3 미니 하이, o1 프로(비전), o1(비전) 모델이 모두 상위권에 위치했다. 이는 오픈AI가 다양한 유형의 AI 모델 개발에서 선두를 달리고 있음을 보여준다.

앤트로픽은 클로드 3.7 소넷 익스텐디드와 클로드 3.7(비전) 모델이 각각 3위와 9위를 차지하며 오픈AI와의 경쟁에서 선전했다. 특히 클로드 3.7 소넷 익스텐디드는 오프라인 테스트에서 118점을 기록하며 높은 성능을 보였다.

한편, 딥시크(DeepSeek)의 R1과 V3 모델은 각각 16위와 18위를 차지했으며, xAI의 그록-3(Grok-3)과 그록-3 씽크(Grok-3 Think)는 19위와 14위를 기록했다. 메타(Meta)의 라마-3.3(Llama-3.3)과 라마-3.2(비전)(Llama-3.2 Vision)은 하위권에 머물렀다.

텍스트 vs 비전: AI 모델의 도메인별 성능 차이 분석

테스트 결과를 통해 텍스트 기반 모델과 비전 기반 모델 간의 성능 차이도 확인할 수 있었다. 흥미로운 점은 동일한 AI 모델이라도 텍스트 처리와 이미지 처리 능력에서 상당한 차이를 보인다는 것이다. 예를 들어, GPT-4o는 텍스트 버전에서 멘사 노르웨이 테스트 94점, 오프라인 테스트 65점을 기록한 반면, 비전 버전에서는 각각 67점과 67점을 기록했다. 이는 동일한 모델이라도 도메인에 따라 성능이 크게 달라질 수 있음을 보여준다.

반면 오픈AI의 o1 프로는 텍스트 버전(멘사 노르웨이 110점, 오프라인 120점)과 비전 버전(멘사 노르웨이 87점, 오프라인 95점) 모두에서 상대적으로 균형 잡힌 성능을 보여주었다. 이는 멀티모달 AI 모델의 발전 방향을 시사한다.

생각하는 AI의 부상: 플래시 씽킹과 확장된 추론 기능의 효과

최근 AI 개발 트렌드 중 하나는 '생각하는(thinking)' 기능을 갖춘 모델의 등장이다. 구글의 제미나이 2.0 플래시 씽킹(Gemini 2.0 Flash Thinking Exp.)과 xAI의 그록-3 씽크(Grok-3 Think)가 이러한 추세를 대표한다. 테스트 결과, 제미나이 2.0 플래시 씽킹은 멘사 노르웨이 테스트에서 84점, 오프라인 테스트에서 111점을 기록했다. 또한 그록-3 씽크는 멘사 노르웨이 테스트에서 86점, 오프라인 테스트에서 108점을 획득했다. 이는 표준 모델보다 더 복잡한 추론을 수행할 수 있는 '확장된 사고' 기능이 실제로 AI의 문제 해결 능력을 향상시킬 수 있음을 보여준다.

클로드 3.7 소넷 익스텐디드 역시 '확장된(Extended)' 버전으로, 기본 모델보다 더 긴 시간 동안 복잡한 추론을 수행할 수 있는 능력을 갖추고 있다. 이 모델이 상위권에 위치한 것은 AI의 '사고 시간'이 성능 향상에 중요한 요소임을 시사한다.

FAQ

Q: IQ 테스트가 AI의 실제 능력을 측정하는 데 적합한 방법인가요?

A: IQ 테스트는 패턴 인식, 논리적 추론 등 특정 인지 능력을 측정하는 데 유용합니다. 그러나 AI의 전반적인 능력을 평가하기 위해서는 다양한 벤치마크와 실제 응용 사례를 함께 고려해야 합니다. Tracking AI의 테스트는 AI 모델 간의 상대적 성능을 비교하는 하나의 지표로 활용될 수 있습니다.

Q: 가장 높은 IQ 점수를 받은 AI 모델이 실제 사용에서도 가장 우수한가요?

A: 반드시 그렇지는 않습니다. IQ 테스트는 특정 유형의 문제 해결 능력을 측정하지만, 실제 사용에서는 문맥 이해, 사용자 의도 파악, 안전성, 편향성 등 다양한 요소가 중요합니다. 따라서 특정 사용 사례에 가장 적합한 모델은 IQ 점수만으로 결정할 수 없습니다.

Q: 일반 사용자가 이러한 AI 모델들을 어떻게 이용할 수 있나요?

A: 대부분의 주요 AI 모델은 웹 인터페이스나 API를 통해 접근할 수 있습니다. OpenAI의 ChatGPT, 앤트로픽의 Claude, 구글의 Gemini 등은 일반 사용자를 위한 서비스를 제공하고 있으며, 일부는 무료 버전도 제공합니다. 기업용으로는 API를 통한 통합 옵션도 있습니다.

해당 기사에서 인용한 테스트 결과는 링크에서 확인할 수 있다.

이미지 출처: 이디오그램 생성 이미지 편집

기사는 클로드와 챗GPT를 활용해 작성되었습니다.

AI Matters 뉴스레터 구독하기

예선 거친 '숨은 장타자' 정유준, 한국오픈 골프 첫날 깜짝 선두(종합)	연합뉴스
'매킬로이 뛰어넘겠다'는 김민수, 한국오픈 첫날 아마 돌풍 예고	연합뉴스
'아 옛날이여' PGA투어 뛰던 4명, 한국오픈 첫날 하위권 '허덕'	연합뉴스
제이디솔루션 "KOBA 2025에서 지향성 음향 대중화" (1)	IT동아
레이드 갈 수 있나, 마비노기M 빙결술사 밸런스 조정한다	게임메카
10대 청소년이 만든 로블록스 모드, 동접 500만 넘었다 (1)	게임메카
전작도 ‘압긍’, 몬스터 트레인 2 스팀서 ‘매우 긍정적'	게임메카
크라트 동물원 등장, P의 거짓 DLC 플레이 영상 공개 (1)	게임메카
자동차 美 관세 부과 직격탄… 전달 이어 5월 수출도 6.3% 감소 비상	오토헤럴드
현대차그룹, '월드 하이드로젠 서밋 2025' 참가…글로벌 협력 강조	오토헤럴드
현대차·기아-인천국제공항공사, AI 기반 전기차 자동 충전 로봇 검증 협력	오토헤럴드
포드·현대에 이어 토요타도…미국 소형 트럭 시장 진입 예고	글로벌오토뉴스
닛산, 6세대 '마이크라' 전기차로 유럽 출시 (1)	글로벌오토뉴스
BMW, i7 테스트 차량에 전고체배터리 탑재…솔리드파워와 공동 개발	글로벌오토뉴스
볼보, 구글과 협력 강화…차량에 '제미나이' AI 도입 예정	글로벌오토뉴스
피아트, 첫 3륜 전기 상용차 ‘트리스’ 공개 (1)	글로벌오토뉴스
엘앤에프, 국내 배터리업체와 LFP 공급 협약 체결…중저가 전기차·ESS 시장 본격 진출	글로벌오토뉴스
342. 르노그룹, 앙페르와 중국 R&D센터 중심으로 미래 개척한다	글로벌오토뉴스
현대차·기아, 인천국제공항과 전기차 자동 충전 로봇 실증 착수	글로벌오토뉴스
최경주재단, SBI저축은행과 업무 협약 체결	연합뉴스
AI로 개선된 FSR과 RDNA4 신규 가성비 VGA, AMD 라데온 RX 9060 XT와 FSR 레드스톤 공개	보드나라
효율적인 워크플로우 및 이미징 솔루션 전시, 소니코리아 KOBA 2025 현장 취재	보드나라
예선 거친 '숨은 장타자' 정유준, 한국오픈 골프 첫날 깜짝 선두	연합뉴스
[순위분석] 멀티플랫폼 게임 최고점, 마비노기M 9위까지	게임메카
5년 만의 귀환, 포트나이트 美 애플 앱스토어 입성	게임메카
[컴퓨텍스 2025] '법인 설립에 부스 전시까지'··· 대만에 진심인 딥엑스 (1)	IT동아
[컴퓨텍스 2025] 모빌린트, 대만 AI PC 업계에 에리스·레귤러스 선보여	IT동아
[컴퓨텍스 2025] 젠슨 황도 찾은 SK하이닉스 부스, 주요 전시 품목은?	IT동아
김아림ㆍ김효주에 이어 유해란도 제로 토크 퍼터로 우승	연합뉴스
기아 EV3, 유로 NCAP 최고 등급 획득… 안전성·상품성 동시 입증	오토헤럴드
10년간 100kg 증가, 비만병에 걸린 자동차 "상대 차량에 과도한 공격성"	오토헤럴드
'만남의 공간으로 변신' 페라리, 새로운 딜러십 CI 반영 첫 전시장 오픈	오토헤럴드
짠돌이로 변한 미국 소비자들, 자동차 평균 수명 12.8년 돌파... 한국은? (1)	오토헤럴드
‘BMW 엑설런스 라운지’ 개최, 럭셔리 로드스터 '콘셉트 스카이탑’ 국내 공개	오토헤럴드
"배운대로 청소하고 요리까지 척척" 테슬라, 진화한 옵티머스 영상 공개	오토헤럴드
"하나라도 잘해" 포르쉐ㆍ폭스바겐 CEO 겸직 '올리버 블룸' 불만 고조	오토헤럴드
폴스타 3, BBC 탑기어 선정 '최고의 전기 SUV' 등 잇단 수상 쾌거	글로벌오토뉴스
위라이드, 아부다비 로보택시 무인 운행 지역 확대…중동 첫 완전 무인 시범 서비스	글로벌오토뉴스
CATL, 혼다차이나와 전략적 협력 강화…배터리 기술·공급망까지 전방위 확대	글로벌오토뉴스
폭스바겐, 이탈디자인 매각 또는 파트너십 검토	글로벌오토뉴스
중국 전기차 업체 네타, 파산 심사 소송 제기돼	글로벌오토뉴스
볼보트럭, 장거리 전기 트럭 ‘FH 에어로 일렉트릭’ 2026년 공개 예정	글로벌오토뉴스
혼다, 전기차 투자 3조 엔 축소…하이브리드 중심 전략으로 선회	글로벌오토뉴스
현대차, 수출 부진으로 울산 전기차 생산 라인 4일간 일시 중단	글로벌오토뉴스
중국, 상용차에 ESC·AEBS 의무화…2025년부터 안전 규제 대폭 강화	글로벌오토뉴스
현대차그룹, 월드 하이드로젠 서밋서 글로벌 수소 생태계 확대 방안 제시	글로벌오토뉴스
BMW 코리아, ‘엑설런스 라운지 2024’ 성료…럭셔리 클래스 고객 대상 특별 경험 제공	글로벌오토뉴스
영국 국왕 찰스 3세, 로터스 전기 SUV ‘엘레트라’ 선택	글로벌오토뉴스
캐딜락, 파르나스 호텔 제주와 전기 SUV ‘리릭’ 체험 패키지 출시	글로벌오토뉴스
페라리, 새 CI 반영한 첫 글로벌 딜러십 로마서 공개	글로벌오토뉴스
한국타이어, 사우디 명문 축구팀 알 이티하드와 타이틀 스폰서십 체결	글로벌오토뉴스
보그워너, 글로벌 OEM과 고전압 수가열 히터 공급 계약 체결	글로벌오토뉴스
스카니아코리아, 김포 직영 서비스센터 신규 오픈	글로벌오토뉴스
포르쉐 코리아, 전기 스포츠카 ‘타이칸 GTS’ 국내 공식 출시	글로벌오토뉴스
토요타, 6년 만에 RAV4 완전 변경… 자체 OS 탑재한 첫 SDV	글로벌오토뉴스
머스크, 트럼프 지원 '대폭 축소' 선언… 테슬라 CEO직은 '확고'	글로벌오토뉴스
전투 분석기 추가, 로스트아크 위기 모면하나	게임메카
[오늘의 스팀] 슈퍼지구 지켜라, 헬다이버즈 2 관심 집중 (1)	게임메카
넷플릭스로 출격, 클래시 오브 클랜 애니메이션 나온다	게임메카
매일 AI 도구 사용하는 직장인 47%... “하이브리드 근무 환경에서 AI가 필수 도구”	AI matters
[구글 I/O 2025] 젠틀몬스터, 구글 AI 스마트 안경 첫 파트너사 선정	AI matters
AI, 대화가 길어질수록 성능 급락… "답변 한 번 잘못 나오면 계속 잘못된 방향으로 답변해"	AI matters
"스스로 생각하는 AI가 공급망 자동화의 한계 뛰어넘는다" 캡제미니 보고서	AI matters
FDA, 전사적 AI 배포 일정 발표… “첫 AI 지원 과학 검토 시범사업의 성공에 깊은 감명”	AI matters
이스트소프트, AI 검색 엔진 '앨런' 크롬 확장 프로그램 출시	AI matters
엘튼 존, 英 AI 저작권 정책에 비난… "정부는 패배자"	AI matters
중국, 미국의 화웨이칩 규제 철회 요구… 미중 무역협상 긴장 고조	AI matters
퍼플렉시티, '무료 체험판' 전략으로 1년 만에 사용량 5배 증가	AI matters
[구글 I/O 2025] AI 혁신으로 무장한 구글의 개발자 컨퍼런스 총정리	AI matters
[구글 I/O 2025] 구글, 지메일·독스·미트에 AI 기능 대거 추가… 워크스페이스 생산성 강화한다	AI matters
“아이케어’에 진심인 벤큐가 말하는 스크린바 헤일로 2	IT동아
[기고] 구글이 공간으로 말하는 일과 삶의 방식	IT동아
[IT강의실] 자동차 ‘스포일러’의 기능과 효과는?	IT동아
[컴퓨텍스 2025] '게이밍 PC가 곧 AI PC'··· MSI 컴퓨텍스 부스 가보니	IT동아
[컴퓨텍스 2025] AMD, '라데온 리더십'으로 AI PC 시장 공략	IT동아
LPGA 투어 3승 유해란 "스윙 문제 찾아…올해 메이저 우승 목표"	연합뉴스
대림대, 골프 영상ㆍ데이터 전문기업 CNPS와 업무 협약	연합뉴스
이승찬, KPGA 챌린지투어 6회 대회서 프로 첫 우승	연합뉴스
르노, 기술 협력 통해 전기차 시대 대응…데 메오 CEO 발언 주목	글로벌오토뉴스
미국, 멕시코산 자동차에 평균 15% 관세 적용	글로벌오토뉴스
정부, 미국 관세 대응 위해 바이오·자동차 산업 긴급 지원책 발표	글로벌오토뉴스
토요타, 차세대 RAV4 공개…독자 OS '아린' 첫 탑재로 SDV 전환 본격화	글로벌오토뉴스
일론 머스크, 정치 후원 축소 선언…테슬라 CEO로 5년 더 재임 의지 밝혀	글로벌오토뉴스
머스크, 정치 기부 줄이고 CEO 5년 연장…투자자들은 안심할까	글로벌오토뉴스
대중골프장협회, 회원사 경영인 대상 응급처치 등 안전 교육	연합뉴스
게임위, '발라트로' 등급 15세 이용가로 재조정 결정	게임메카
"와 이게 라이다야" 호기심에 스마트폰 카메라 들이 댔다가 영구적 손상	오토헤럴드
BMWㆍ벤츠 비켜라… 중국 프리미엄 시장 압도한 ‘듣보잡’ 브랜드 '아이토'	오토헤럴드
'중국 판매량의 0.1%' GM, 미 · 중 관세 전쟁 여파로 대중국 수출 중단	오토헤럴드
'화재 발생 가능성' 기아 · BMW 인기 모델 등 14개 차종 1만 6577대 리콜	오토헤럴드
한국타이어 웨더플렉스 GT, 레드닷 디자인 어워드 2025 본상 수상	오토헤럴드
타타대우모빌리티, 협력사 상생협력 ‘협진회 정기총회 및 벤더 컨퍼런스’	오토헤럴드
"이 가격 실화" 도요타, 테슬라 모델 Y 절반 수준 2000만원대 'bZ5' 공개	오토헤럴드
[EV 트렌드] '돌발 시 원격 대처' 테슬라, 내달 텍사스 오스틴서 로보택시 운행	오토헤럴드
GM 한국사업장, KSQI 우수 콜센터 22년 연속 선정...서비스 역량 입증	오토헤럴드
[영상] 전기차 느낌 물씬, 푸조 308 스마트 하이브리드의 매력	글로벌오토뉴스
재규어, 초호화 전략으로 브랜드 이미지 대변혁 시도	글로벌오토뉴스
폭스바겐 CEO, MEB 플랫폼 추가 개발 계획 확인… 내년 ID.2 출시와 함께 MEB+ 시대 개막	글로벌오토뉴스
폴스타, 자동차 탄소 발자국 공개…‘가장 투명한 EV 제조사’ 평가	글로벌오토뉴스
유럽, 전기차 전환 놓고 '녹색 대 적색' 격돌… 목표 달성 불확실성 속 정책 변화 조짐	글로벌오토뉴스

비교하고 잘 사는, 다나와 : 가격비교 사이트

RanKING 100 도움말 보기

GNB 메뉴

GNB 메뉴

AI 모델 IQ 테스트 결과는? 구글 제미나이 2.5 프로, IQ 130으로 1등

비교하고 잘 사는, 다나와 : 가격비교 사이트

RanKING 100 도움말 보기

GNB 메뉴

GNB 메뉴

AI 모델 IQ 테스트 결과는? 구글 제미나이 2.5 프로, IQ 130으로 1등

공유하기

공감/비공감