비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

줌, ‘AI 최고 난도 시험’ 최고점 기록 주장…업계는 “모델이 아닌 조합의 성과” 논쟁

다나와
2025.12.17. 21:28:01
조회 수
1,033
22
댓글 수
1

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

출처 : 챗GPT 생성 이미지


 화상회의 플랫폼으로 알려진 줌(Zoom)이 인공지능(AI) 분야에서 가장 까다로운 평가로 꼽히는 벤치마크 시험에서 역대 최고 점수를 기록했다고 발표하며 기술 업계의 주목을 받았다. 그러나 자체 AI 모델을 개발하지 않고 기존 거대언어모델(LLM)을 조합한 결과라는 점에서, 이를 혁신으로 볼 수 있는지를 두고 논쟁이 이어지고 있다.


 16일(현지 시간) 벤처비트(Venturebeat)에 따르면 줌은 자사 AI 시스템이 ‘휴머니티스 라스트 이그잼(Humanity’s Last Exam·HLE)’에서 48.1%의 점수를 기록했다고 밝혔다. 이는 기존 최고 기록이었던 구글 ‘제미니 3 프로’의 45.8%를 2.3%포인트 웃도는 수치다. HLE는 수학·과학·철학 등 다양한 고난도 영역에서 다단계 추론과 종합적 이해를 요구하는 시험으로, AI의 한계를 가늠하는 지표로 활용된다.


출처 :  agi.safe.ai/


 다만 줌은 자체 대형 모델을 학습시키지 않았다. 대신 오픈AI, 구글, 앤스로픽 등 여러 AI 모델을 동시에 활용하는 ‘연합형(federated) AI 접근법’을 구축했다. 질문을 여러 모델에 분산 전달한 뒤, ‘Z-스코어러’로 불리는 내부 시스템이 답변을 평가·선별·결합하는 방식이다. 줌은 이를 “AI를 만드는 것이 아니라, AI를 지능적으로 조율하는 시스템”이라고 설명했다.


출처 : (zoom) 블로그


이 같은 접근을 두고 업계 평가는 엇갈린다. 일부 연구자들은 “타사의 API를 조합해 얻은 결과를 자체 성과처럼 포장했다”고 비판한다. AI 엔지니어 맥스 룸프는 X를 통해 "줌은 제미니, GPT, 클로드 등의 API 호출을 짜깁기해서 고객에게 아무런 가치도 제공하지 않는 벤치마크를 약간 개선했을 뿐"이라며 "그런데도 최첨단이라고 주장한다"고 썼다. 반면 데이터 과학 경진대회에서 여러 모델을 결합하는 앙상블 기법이 표준이라는 점을 들어, 실용적이고 합리적인 전략이라는 옹호도 나온다.


 이번 논쟁의 핵심은 ‘최고의 모델’이 아니라 ‘최고로 활용하는 시스템’이 AI 경쟁력의 기준이 될 수 있느냐는 점이다. 궁극적인 평가는 벤치마크가 아니라, 향후 출시될 줌의 AI 기능이 실제 사용자에게 어떤 가치를 제공하느냐에 달릴 것으로 보인다.


글 / 김지훈 news@cowave.kr

(c) 비교하고 잘 사는, 다나와 www.danawa.com

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
저작권 안내
크리에이트 커먼즈 저작자 표시 필수 상업성 이용 불가 컨텐츠 변경 불가
저작권 안내
저작권 표시 필수
상업성 이용 불가
컨텐츠 변경 불가
* 본 내용은 위의 조건을 충족할 시, 별도의 허가 없이 사용이 가능합니다.
최신 일반뉴스 전체 둘러보기
1/1
EU 이사회, AI 법 간소화 합의… 비동의 성적 딥페이크 생성 AI 명시적 금지 AI matters
백악관, AI 규제 프레임워크 발표 임박… '4C' 핵심 의제로 부상 AI matters
마이크로소프트, 코파일럿 AI 리더십 대거 개편… 술레이만은 신모델 개발 집중 AI matters
구글, 맥용 제미나이 앱 비공개 테스트 돌입… 챗GPT·클로드 대항마로 AI matters
빛으로 빚은 BMW의 얼굴, 크롬을 지우고 미래를 채우다 글로벌오토뉴스
아는 만큼 즐긴다. ‘붉은사막’ 플레이 전에 알아야 할 점들은? 게임동아
'일곱 개의 대죄: 오리진' 해보니, 그랜드 론칭 기대감 UP 게임동아
엠게임 2026 비전 발표회 개최. 신성장 위한 준비 구체화 게임동아
넷마블 '킹 오브 파이터 AFK'에 의적단 두목 'B. 제니' 업데이트 게임동아
리비안·우버, R2 기반 로보택시 동맹 '2028년 상용화' 목표 오토헤럴드
토요타, 센추리 전용 쇼룸 도쿄에 첫 개설 '독립 브랜드 전략' 가속 오토헤럴드
KGM, 현장 적용형 AI 휴머노이드 로봇 투입으로 생산 현장 혁신 가속 오토헤럴드
벤츠, C 클래스 전기 세단 공개 임박 '실패한 EQ 전략의 수정 무대' 오토헤럴드
기아 82기 주총, EV·PBV·SDV 3축 전략 '전자 주총·집중투표제' 도입 오토헤럴드
글로벌 역풍 속 한국만의 역주행, 포르쉐코리아 세계 5위 시장으로 글로벌오토뉴스
엔비디아, GTC 2026서 자율주행 영토 확장… 현대차·우버 등 글로벌 동맹 강화 글로벌오토뉴스
메르세데스 벤츠, 중국 지리자동차와 차세대 전기차 플랫폼 협력 논의… 피닉스 프로젝트 가동 글로벌오토뉴스
미국 라이텐, 노스볼트 독일 부지 인수 확정… 2028년 배터리 양산 및 1,000명 고용 글로벌오토뉴스
현대오토에버-톰톰, 유럽서 매달 지도 업데이트 서비스 글로벌오토뉴스
아마존 엔비디아, 차량용 멀티모달 AI 비서 공동 개발… 2027년 초 상용 테스트 돌입 글로벌오토뉴스
이 시간 HOT 댓글!
1/4