로그인하세요
알림
설정
레프트패널 닫기
관심
최근본
마이페이지
출석체크
카테고리
    서비스 바로가기
    • 자동차
    • 인기 서비스조립PC
    • PC견적
    • PC26
    • 신규 서비스LIVE쇼핑
    • 커뮤니티
    • 이벤트
    • CM추천/문의
    • 오늘의 특가
    앱 서비스
    • 자동차
    • PC견적
    • 장터
    인기 쇼핑몰
    • 지마켓
    • 쿠팡
    • 옥션
    • 11번가
    • LG전자
    • 하이마트
    • 전자랜드
    • 롯데아이몰
    • SSG
    • CJ 온스타일
    • GS샵
    • 롯데닷컴(롯데온)
    • 현대Hmall
    • 이마트몰
    • SK스토아
    • 더현대닷컴
    • 엘롯데
    • 신세계몰
    • NS몰
    • 홈플러스
    • 공영쇼핑
    • 홈앤쇼핑
    • 신세계 라이브쇼핑
    • 오늘의 집
    • 배민상회
    • 동원몰
    • LF몰
    • ZETTA몰
    PC버전 로그인 개인정보처리방침 고객센터
    (주) 커넥트웨이브
    대표:
    김정남
    주소
    서울특별시 금천구 벚꽃로 298, 17층(가산동, 대륭포스트타워6차) (우) 08510
    • 사업자번호:
      117-81-40065
    • 통신판매업:
      제2024-서울금천-0848호
    • 부가통신사업:
      제003081호
    • 고객센터:
      1688-2470 (유료)
    • 이메일:
      cs@cowave.kr
    • 호스팅 제공자:
      (주)커넥트웨이브
    • 사업자 정보확인
    • 이용약관
    • 책임의 한계
    • 청소년 보호정책
    사용법 보기
    MY쇼핑이란? 자주 쓰는 쇼핑몰을 연결하면 쇼핑몰 주문내역을 한 번에 확인할 수 있습니다. 쇼핑몰 계정은 고객님의 핸드폰에만 저장되어 안전합니다.
    편리한 구매내역 확인. 다양한 쇼핑몰의 주문내역을 한 곳에서 확인해보세요.
    가격비교와 최저가 쇼핑을 한 번에. 자주 구매하는 상품은 가격비교를 통해 저렴하게 구매하세요.
    보안은 필수! 쉽고 편한 가치 쇼핑. 쇼핑몰 계정은 고객님의 핸드폰에만 암호화 저장되어 안전합니다. 쇼핑몰 연결
    다나와 홈

    커뮤니티 DPG

    일반뉴스

    • 게시판
    • 상품포럼
    • 뉴스
    • 동영상
    • 커뮤니티 공지사항
      소비자사용기
    • 특가몰
      자유게시판
    • 이달의 이벤트
      유머게시판
    • 당첨자발표게시판
      댕냥이게시판
    • 포인트 마켓
      Q&A게시판
    • 다나와 래플
      상품의견
    • 모두의 경매
      체험단
    • 오늘도 출석체크
      엄근진게시판
    • 입소문쇼핑
      쇼핑몰후기
    • 메인가자
      A/S후기
    • 당첨후기
    • 컴퓨터
      AI
    • 푸드
      취미
    • 최신뉴스
      일반뉴스
    • 기획뉴스
      신상품뉴스
    • 쇼핑뉴스
      테크팁
    • 다나와리포터
      구매가이드
    • 전문가리뷰
      인기순위가이드
    • 벤치마크
      차트뉴스
    • 가격동향
    • 고나고
      공구왕황부장
    • 노써치
      도레
    • 딴트공 말방구 실험실
      라이브렉스
    • 맛상무
      모터피디
    • 무적풍화륜
      민티저
    • 보드나라
      뻘짓연구소
    • 여행매거진 트래비TV
      오토기어
    • 조코딩 JoCoding
      인프제 INFJ
    • 주연 ZUYONI
      진블로그
    • 집마 홀릭TV
      톡써니
    • 포마: 탈 것을 리뷰하는 남자
      쿨엔조이
    • 훅간다TV
      AI 매터스
    • Allthatboots TV
      DmonkTV
    • Hakbong Kwon
      Motorgraph
    • PC SNAP
      Producer dk
    • THE EDIT
      UnderKG
    • 다나와 공식채널
      답나와
    • 리뷰나와
      샵다나와 조립갤러리
    >
    이전 글
    다음 글
    IT동아

    독자 AI 파운데이션 2차 평가 임박··· 각 모델 별 기술로 살펴본 승부수는?

    2026.08.07. 02:19:41
    읽음388

    [IT동아 남시현 기자] 2025년 8월 시작된 ‘독자 AI 파운데이션(이하 독파모)’ 사업이 2차 평가를 눈앞에 두고 있다. 독파모 사업은 해외 거대 AI 모델 의존에서 벗어나 한국만의 AI 주권을 확보하고, 국내 산업 인프라 및 AI 생태계 지원을 목표로 시작했다. 1차 평가에서는 모델의 독자성과 언어모델의 구성을 집중적으로 검증했으며 업스테이지, LG AI 연구원, NC AI, 네이버클라우드, SK텔레콤 중 NC AI, 네이버클라우드 두 개 기업이 고배를 마셨다. 이후 2차 평가에서는 모티프테크놀로지가 기술 독자성을 인정받아 새롭게 합류했으며 6개월 간의 여정을 마치고 이제 막 평가를 기다리는 상황이다.

    독자 AI 파운데이션 사업은 5개 컨소시엄으로 시작해 2개가 탈락하고, 다시 1개 컨소시엄이 합류해 현재 4파전을 벌이고 있다. 8월 중에 1개 컨소시엄이 탈락하고 올해 12월 중 추가로 탈락해 2개만 남는다 / 출처=제미나이 이미지 생성
    독자 AI 파운데이션 사업은 5개 컨소시엄으로 시작해 2개가 탈락하고, 다시 1개 컨소시엄이 합류해 현재 4파전을 벌이고 있다. 8월 중에 1개 컨소시엄이 탈락하고 올해 12월 중 추가로 탈락해 2개만 남는다 / 출처=제미나이 이미지 생성

    우리 정부는 글로벌 프런티어 모델의 95%에 가까운 성능을 달성할 것을 목표로 설정했으며, 1차 평가에서 언어 모델 2차 평가에서 멀티모달 모델, 3차 평가에서 액션 모델로 구체적인 모델 구성을 잡았다. 이에 따라 2차 평가는 대형언어모델의 성능뿐만 아니라 산업 현장에서 에이전트 AI 활용 방안, 그리고 텍스트, 이미지, 비디오 등 다양한 형태의 데이터를 동시에 인식하고 결합하는 멀티모달 기술의 성능 평가를 집중적으로 진행할 예정이다. 보고서 및 제출이 완료된 현재 시점에서 공개된 기술 보고서와 정보를 조합해 각 모델 구성을 살펴봤다.

    업스테이지 솔라 오픈 2, AI 에이전트 성능 대폭 강화

    업스테이지의 솔라 오픈 2, 총 2500억 개의 매개변수가 적용됐다 / 출처=업스테이지
    업스테이지의 솔라 오픈 2, 총 2500억 개의 매개변수가 적용됐다 / 출처=업스테이지

    업스테이지 솔라 오픈 2는 전작의 1020억 개 매개변수를 두 배 이상인 총 2500억 개(250B)로 구성한 모델이다. 실제 연산 시에는 150억 개 수준의 연산량만 활용하며, 한 번에 100만 개의 토큰을 처리할 수 있어 길고 복잡한 AI 에이전트도 맥락을 벗어나지 않고 한 번에 다룬다. 또한 이전 모델에서 약 2.3%에 해당하는 핵심 가중치를 재사용해 학습 시간을 크게 줄었고, 한국어 입력 시 토큰 효율성을 더 끌어올렸다. 아울러 2차 평가 기준인 에이전트 성능 확보를 위해 대화형 도구 사용, 코딩 및 사무 업무를 포괄하는 에이전트 시나리오를 학습했다.

    솔라 오픈 2와 오픈 1, 딥시크 V4 플래시 및 미모-V4, GPT 5.4 미니와의 성능 비교 / 출처=업스테이지
    솔라 오픈 2와 오픈 1, 딥시크 V4 플래시 및 미모-V4, GPT 5.4 미니와의 성능 비교 / 출처=업스테이지

    성능 측면에서는 지식 및 과학 추론, 수학, 코딩, 지시 이행, 한국어 종합 성능이 전반적으로 크게 향상됐다. 기존에 솔라 오픈 100B에서 축적된 자료와 학습 경험을 바탕으로 새로운 아키텍처를 구성한 덕분이다. 박사 급 과학분야 추론 문제 198개로 구성된 GPQA-다이아몬드 테스트에서는 1세대 정확성이 66.2%이었는데 86.3%로 크게 올랐다. 라이브 벤치 v6 성능도 56.5%에서 92.4%로 대폭 향상됐으며, 올림피아드 급 수학 문제로 구성된 AIME2026도 87.7%에서 95.7%로 정확도를 높였다. 전반적인 성능은 글로벌 프론티어 급인 딥시크-V4 플래시 284-A13B 모델 수준이다.

    특히 전 세대에서 부족했던 AI 에이전트 성능은 괄목할 만큼 성장했다. 사실 이전 모델에서 AI 에이전트는 평가 기준이 아니어서 상대적으로 소홀한 면이 있었다. 자율소프트웨어 역량 벤치마크인 SWE-벤치는 전세대가 15.4%였는데 이번에 70.4%로 크게 올랐고, 격리된 가상의 터미널 환경에서 작업 역량을 확인하는 터미널 벤치 하드 테스트도 2.3%에서 28.3%으로 올랐다. 총 45가지 주제에 걸쳐 3만 5030개의 전문가 질문이 다지선다형으로 구성된 한국어 AI 성능 평가 지표인 KMMLU-프로는 78.4점으로 전작의 64.02점보다 높아졌다.

    AI 양자화 기술 기업 노타가 솔라 오픈 2를 양자화해 요구 메모리를 160GB 이하로 줄여 활용성을 크게 높였다 / 출처=노타
    AI 양자화 기술 기업 노타가 솔라 오픈 2를 양자화해 요구 메모리를 160GB 이하로 줄여 활용성을 크게 높였다 / 출처=노타

    주목할만한 부분은 하드웨어 요구사항이다. 최소 사양은 엔비디아 H200 4장, 권장 사양은 8장으로 온프레미스 조건은 중견기업은 되어야 할 만 하다. 업스테이지는 AI 모델 양자화 기술 기업 노타와의 협업으로 4비트 양자화에 전역 가지치기를 적용한 경우 모델 규모를 H100 2 장에서 구동 가능한 137.8GB로 크게 줄였다. 엔비디아 블랙웰 이상에서 지원하는 NVFP4 조건에서는 블랙웰 B200 1장으로도 구동할 수 있다. 덕분에 데이터서버용 그래픽 카드 수급이 어려운 조건은 물론 온프레미스 환경, 폐쇄망에서까지도 솔라 오픈 2를 무난하게 쓸 수 있다.

    SK텔레콤, 고성능 에이전트에 688B 결합한 A.X K2 공개

    SK텔레콤의 A.X K2 로고. 전작 대비 매개변수는 1690억 개 늘리면서 학습 방식을 바꿔 성능과 효율을 높였다 / 출처=SK텔레콤
    SK텔레콤의 A.X K2 로고. 전작 대비 매개변수는 1690억 개 늘리면서 학습 방식을 바꿔 성능과 효율을 높였다 / 출처=SK텔레콤

    A.X K2는 5190억 개 매개변수가 적용된 A.X K1의 후속 모델로 총 6880억 개 매개변수가 적용됐다. 멀티모달 부분을 고려해 A.X K2 메인 모델 이외에도 이미지를 분석하는 A.X K2 VE, 음향 부분에 대응하는 A.X K2 ALM, 음성 모델인 A.X K2 Raon-Speech가 함께 출시됐다.

    전작과 동일하게 전문가 모델 활성 매개변수는 330억 개지만 전문가 구조가 192명 전문가 및 주력 1명 구조에서 256명 및 1명으로 업그레이드됐다. 콘텍스트 길이는 13만 토큰 수준에서 26만 토큰으로 두 배 가량 늘었다. A.X K1의 아키텍처는 추론 시 발생하는 KV 캐시를 저 차원 잠재 영역으로 압축해서 저장하는 멀티 헤드 잠재 어텐션(MLA)으로 요구 메모리를 효율화했는데, A.X K2는 MLA에 불필요한 토큰 집중 연산을 줄이는 희소 어텐션과 정보 필터링 및 안정성을 끌어올린 게이티드 어텐션을 결합한 희소 게이티드 어텐션을 추가로 적용해 AI 에이전트 실행을 위한 문맥 추론 길이는 늘리고 속도와 안정성을 확보했다.

    A.X K2와 글로벌 프런티어 모델과의 주요 성능 비교 / 출처=SK텔레콤
    A.X K2와 글로벌 프런티어 모델과의 주요 성능 비교 / 출처=SK텔레콤

    성능은 GPQA-다이아몬드가 85.6%며, AIME 2026은 97.1%로 우수한 지능 점수를 보여줬다. 라이브 벤치 v6는 84%로 1세대의 74.9%에 비하면 올랐지만 매개변수가 절반 정도인 3970억 개에 170억 개 전문가 모델이 동작하는 큐웬 3.5의 82.6%와 크게 다르지 않아 아쉽다. 한국어 성능을 확인하는 KMMLU-프로는 전작이 68.9점이었으나 80.5점으로 크게 높였다.

    주목할만한 점은 모델 크기가 크다보니 학습 방식을 FP8 혼합정밀도에서 네이티브 MXFP8로 변경했다. 1세대 모델은 메인 매개변수는 FP32, BF16으로 관리하며 학습 중 FP8 연산을 활용하는 방식이었지만, 2세대 모델은 배포파일 자체를 FP8로 저장하는 MXFP8로 전환함과 동시에 데이터를 32개 수준의 더 작은 블록 단위로 조절해 수치 손실을 줄이고 정밀도를 높였다. MXFP8은 글로벌 서버 표준을 제정하는 오픈 컴퓨트 프로젝트(OCP)에서 제정한 표준이고, 엔비디아 블랙웰에서 텐서코어 레벨에서 처리되므로 향후 확산 시 활용 가치가 높다.

    누구나 이용할 수 있는 아파치 2.0 라이선스로 배포돼 AI 생태계 침투력을 크게 높였다 / 출처=허깅페이스
    누구나 이용할 수 있는 아파치 2.0 라이선스로 배포돼 AI 생태계 침투력을 크게 높였다 / 출처=허깅페이스

    다만 MXFP8로 요구 메모리를 절반이나 줄였음에도 불구하고 활성 용량이 647 GiB(기비바이트), KV 캐시 및 활성화를 포함하면 800 GiB의 막대한 GPU 메모리가 필요하다. 검증에는 4개의 엔비디아 B300 카드가 활용됐는데 엔비디아 H100으로 환산하면 12장 이상이 필요한 수준이다. 긍정적인 점은 라이선스가 아파치 2.0으로 배포돼 상업적 이용, 수정, 재배포가 모두 가능하다. 소규모 스타트업들도 A.X K2, VE를 기반으로 서비스를 제작하고 만들어도 무방하다. 대신 ALM은 비상업적-연구 용도로만 쓸 수 있고, 라온 스피치는 저작자 표시 및 비상업 용도로만 쓸 수 있다.

    LG AI 연구원, 3배 커진 749B K-EXAONE 2.0으로 승부수

    LG AI 연구원의 2세대 모델은 K-EXAONE 2.0 주요 변경점 / 출처=LG AI 연구원
    LG AI 연구원의 2세대 모델은 K-EXAONE 2.0 주요 변경점 / 출처=LG AI 연구원

    LG AI 연구원의 K-EXAONE 2.0은 전작 대비 매개변수를 3.2배 키운 7490억 개 초대형 모델로 승부수를 띄웠다. 아키텍처는 기존의 희소성 MoE 모델에 레이어를 48에서 78로 올리고, 동원 전문가는 256으로 늘린 뒤 매개변수를 236B에서 749B로 확장한 구조다. 모델 크기가 커지다보니 추론 가속을 위해 DSpark라는 선택지가 새롭게 도입된다. 1세대 모델은 사전 모델이 초안 단어를 만든 뒤 주력 모델이 일괄 검수하는 다중 토큰 예측(MTP)만 사용됐는데, 2세대는 별도로 학습된 모듈이 7개 토큰 크기의 블록을 한 번의 연산으로 초안을 찍어내는 DSpark 레이어 활용 버전을 추가해 초당 토큰 생성 속도를 1.81배에서 최대 2.57배 늘렸다.

    장문맥 탐색 및 추론 성능, 지시 준수 및 안정성 점수는 크게 올랐으나 전반적인 지식 성능은 거의 비슷했다. 실제 환경 에이전트 과제 성능은 3세대 모델에서 해결해야할 숙제로 남았다 / 출처=LG AI 연구원
    장문맥 탐색 및 추론 성능, 지시 준수 및 안정성 점수는 크게 올랐으나 전반적인 지식 성능은 거의 비슷했다. 실제 환경 에이전트 과제 성능은 3세대 모델에서 해결해야할 숙제로 남았다 / 출처=LG AI 연구원

    다만 매개변수를 세배나 높인 것에 비해 벤치마크 점수가 크게 높아지지 않았다. GPQA-다이아몬드는 전작이 79.1%에서 82.2%로 소폭 올랐고, AIME2026은 전작의 92.2%에서 0.1% 오른 92.3%로 큰 차이가 없었다. KMMLU-프로는 전작이 67.3점이었는데 69.1로 오름폭이 적었다. 오히려 매개변수가 330억 개로 구성된 엑사원 4.5가 AIME 2026이 92.6점, KMMLU-프로가 67.6점임을 감안하면 기대했던 만큼 성능이 나오진 않는다. 기술 보고서에서는 지표 향상보다는 에이전틱 코딩, 초장문 맥락 이해, 도구 사용 등 실무 서빙에 필요한 핵심 역량 향상에 집중했다고 서술했다.

    실제 성능 향상은 AI 코딩 및 에이전트 벤치마크 세 종에서 약 30%의 성능 향상을 기록했으며, 최대 지원 콘텍스트의 길이는 25만 6000토큰으로 유지하면서 효율을 크게 끌어올린 점을 강조한다. 토큰 윈도우 크기를 의미하는 슬라이딩 윈도우 크기는 기존에는 일률적으로 128으로 고정했으나 새 버전에는 두 번째 레이어를 적용해 크기를 4096으로 넓혀 초반 문맥 수용력을 넓혔고, 사전 학습 이후 중간 단계에서 추가로 학습하는 미드 트레이닝을 추가해 장문 추론 추적, 에이전트 실행 이력 확인 성능 등을 높였다. 덕분에 긴 문맥 속에서 여러 위치에 흩어진 정보를 찾아 연계하는 오픈AI-MRCR 점수는 52.3점에서 94.4점으로 대폭 향상됐다.

    좌측이 K-EXAONE 2.0의 메인 모델 아키텍처, 우측 상단이 다중토큰예측(MTP) 모듈, 하단이 DSpark 모듈 구조다 / 출처=LG AI 연구원
    좌측이 K-EXAONE 2.0의 메인 모델 아키텍처, 우측 상단이 다중토큰예측(MTP) 모듈, 하단이 DSpark 모듈 구조다 / 출처=LG AI 연구원

    매개변수가 크다보니 하드웨어 요구 성능도 높다. 일단 A.X K2와 마찬가지로 다중 토큰 예측을 활용하고, MTP 대신 5개의 DSpark 레이어를 적용한 별도 모델도 공개해 추론 속도는 솔라 오픈 2나 모티프 3보다 빠를 것으로 예상된다. BF16으로 구동 시 하드웨어는 8개의 H200으로 구성된 노드 두 개, 즉 H200 16개가 필요하다. FP8 환경이면 귄장 VRAM이 가중치 750GB에 KV캐시를 포함해 900GB 수준으로 H200 8개가 필요하다. 엔비디아 블랙웰 B200을 활용하면 권장 VRAM을 500GB까지 줄여 4대의 B200으로도 충분하다.

    퓨리오사AI가 1세대 모델인 K-EXAONE-236B 모델을 자사의 AI 가속기인 RNGD(레니게이드)에서 NVFP4로 구동할 수 있는 모델을 허깅페이스에 업로드했다 / 출처=허깅페이스
    퓨리오사AI가 1세대 모델인 K-EXAONE-236B 모델을 자사의 AI 가속기인 RNGD(레니게이드)에서 NVFP4로 구동할 수 있는 모델을 허깅페이스에 업로드했다 / 출처=허깅페이스

    하드웨어 요구 사항이 이례적으로 높긴 하나 퓨리오사AI의 NPU RNGD가 해답이 될 수 있다. 퓨리오사AI는 지난 7월 1세대 모델인 K-EXAONE-236B-A23B를 NVFP4로 구동하는 모델을 업로드했다. 해당 모델이 4장의 RNGD 카드만으로 구동되는 점을 감안하면 아키텍처를 유지하며 매개변수를 3배로 늘린 2세대 모델은 약 12장 정도면 구성할 수 있을 것으로 추정된다. NVFP4용 엔비디아 B200의 개별 제품 단가와 전력효율을 고려하면 GPU 대비 약 25~30%의 총소유비용과 6배 적은 소비전력으로도 K-EXAONE 2.0를 활용할 수 있을 것이다.

    모티프 3, 자체 기술로 글로벌 프런티어급 성능 달성

    모티프테크놀로지스의 모티프-3는 현재 베타 버전으로 등록돼있다. 조만간 공식 버전이 출시될 전망이다 / 출처=허깅페이스
    모티프테크놀로지스의 모티프-3는 현재 베타 버전으로 등록돼있다. 조만간 공식 버전이 출시될 전망이다 / 출처=허깅페이스

    모티프는 컨소시엄에 가장 마지막으로 참여한 만큼 허깅페이스 상에는 모티프 3 베타 버전만 공개했으며 지난 4일 정보통신산업진흥원에 모티프 3 및 성과보고서를 제출한 것으로 알려졌다. 모티프 3는 오픈소스 아키텍처를 사용하지 않고 모티프 테크놀로지스가 완전히 독자적으로 설계한 모델이며, 총 3140억 개의 매개변수와 130억 개의 활성 매개변수를 갖췄다. 모티프 3는 전문가는 384개, 공유 전문가는 1개로 전문가당 매개 변수를 0.8B로 매우 작게 쪼갰고, 토큰당 활성 전문가는 8개를 배치했다. 결과물이 더 세밀하고 유연하게 나올 수 있는 구조다.

    모티프-3는 베타 버전으로도 아티피셜 애널리시스의 지능 테스트에서 44점을 획득하는 등 우수한 성능을 보여줬다 / 출처=아티피셜애널리시스
    모티프-3는 베타 버전으로도 아티피셜 애널리시스의 지능 테스트에서 44점을 획득하는 등 우수한 성능을 보여줬다 / 출처=아티피셜애널리시스

    또한 그룹화 차분 잠재 어텐션(GLDA)이라는 구조도 적용했다. GLDA는 문맥상 관련이 적은 단어를 줄이는 차분 어텐션, KV캐시를 벡터로 압축해 메모리를 줄이는 잠재 어탠션, 두 어텐션을 활용할 때 병렬 처리 및 자원 할당 등을 관리하는 그룹화 작업을 엮은 기술로 메모리 효율과 추론 속도는 높이는 기술이다. 모티프가 올해 2월 합류해 30여 명의 인원과 700장의 GPU만으로 학습했음을 감안하면 구조의 독창성이나 완성도가 매우 우수한 편이다.

    구체적인 요구 GPU 사양은 공개되지 않았으나 테스트는 엔비디아 H200 및 B200에서 처리되었으며 vLLM을 활용했을 때 8대의 GPU를 데이터 병렬화로 구성한 것을 고려하면 H200 8장 정도는 필요할 것으로 예상된다. 모델 자체는 BF16으로 구성되어 향후 모델 양자화시 요구 하드웨어 사양은 더 줄어들 수 있다. 8비트 양자화는 텐서가 아닌 블록 단위로 가능하고, 4비트 양자화는 시험 단계라고 밝히고 있다.

    모티프-3 베타 버전의 GPQA-다이아몬드 테스트 정확성은 87%, 터미널-벤치 v2.1도 71%로 높게 확인된다 / 출처=아티피셜애널리시스
    모티프-3 베타 버전의 GPQA-다이아몬드 테스트 정확성은 87%, 터미널-벤치 v2.1도 71%로 높게 확인된다 / 출처=아티피셜애널리시스

    베타 버전이 아닌 정식 버전 출시 시점에는 모델 양자화나 구체적인 성능 등이 공개될 예정이다. 한편 모티프 3는 정식 버전이 아님에도 불구하고 글로벌 AI 벤치마크 기관인 아티피셜 애널리시스의 지능지수 검증에서 44점을 획득했다. 해당 항목에서 확인할 수 있는 GPQA-다이아몬드 정확성은 87%, 터미널 벤치 2.1 버전은 71%다. K-EXAONE 2.0이 각각 82.2%, 43.8%인 점을 감안하면 예상 수준을 상회하는 성능이며 정식 버전에서는 점수가 더 향상될 여지가 있다.

    오는 8월 11일까지 국민참여단 평가··· 이후 4팀 중 3팀만 생존

    모티프까지 모델 전달을 완료하면서 독자 AI 파운데이션 2차 평가가 곧 시작된다. 정부는 오는 8일부터 11일까지 일반 국민 200명이 참여하는 국민평가단을 운영한다. 각계각층으로 구성된 200명의 평가단이 4개 AI 모델을 직접 사용한 뒤 절대평가 방식으로 채점한다. 2차 결과는 해당 기준과 벤치마크 평가, 그리고 전문가 평가 점수를 종합한 뒤 12일 이후에 윤곽을 드러낼 예정이다. 2차 평가를 거치면 4개 팀 중 하나 팀이 탈락하고, 올해 연말에 최종 평가를 통해 두 개 팀만 남게 된다.

    정부가 요구하는 AI 모델의 핵심은 단순 지표가 아닌 AI 에이전트, 즉 현실에서의 활용 가치다. 제시한 모델을 얼마나 산업적 가치로 승화시키는가가 선정의 관건이 될 전망이다 / 출처=LG AI 연구원
    정부가 요구하는 AI 모델의 핵심은 단순 지표가 아닌 AI 에이전트, 즉 현실에서의 활용 가치다. 제시한 모델을 얼마나 산업적 가치로 승화시키는가가 선정의 관건이 될 전망이다 / 출처=LG AI 연구원

    각 기업 모델의 주요 특징과 기술 보고서만으로는 AI 모델의 성능이나 실용성 등은 예측할 수 없다. 2차 평가의 기준은 AI 에이전트의 수행 능력과 산업 현장의 적용성, 개방성, 생태계 확장성 등을 종합적으로 평가하며 이는 라이선스나 벤치마크 상으로는 확인할 수 없다. 또한 모델의 서빙 속도나 이용 비용 등 기술 외적인 부분도 고려하지 않을 수 없다. 실제로 모델 성능이나 지능은 높아도 토큰 생성 속도가 느려서 활용성이 부족한 경우도 있고, 반대로 모델 크기 대비 AI 에이전트 성능이 기대 이상인 모델들도 많다. 2차 평가에서 실제로 국민들이 AI를 써보는 평가가 들어간 이유다.

    배경훈 정보통신부장관은 지난 7월 열린 2026 하반기 업무보고 과정에서 ‘독파모 2차 평가가 나오면 기존 3위를 넘어 2위권에도 도전해볼 수 있을 것’이라며 기대감을 나타냈다. 당장 모티프가 700여 장의 B200만으로 세계적 수준의 모델을 만든 점을 감안하면 정부의 전폭적인 지원을 통해 더 큰 결과도 창출해 낼 여력이 있다. 지난 6개월 간의 개발 여정은 이제 마무리되었고 그 결과만을 남겨두고 있다. 남은 것은 기다림 뿐이다.

    IT동아 남시현 기자 (sh@itdonga.com)

    안내 ?

    말 많은 뉴스

    • 1

      아이폰 듀오를 왜 살까?

      댓글6
      아이폰 듀오를 왜 살까?
    • 2

      지클릭커 오피스프로 WK50 사일런스 M RGB LCD 99 : LCD를 탑재한 오피스 키보드!

      댓글5
      지클릭커 오피스프로 WK50 사일런스 M RGB LCD 99 : LCD를 탑재한 오피스 키보드!
    • 3

      충전기 없이 하루 종일 쓰는 노트북? 직장인·대학생을 위한 초경량 ASUS 젠북 S 14 [노리다]

      댓글3
      충전기 없이 하루 종일 쓰는 노트북? 직장인·대학생을 위한 초경량 ASUS 젠북 S 14 [노리다]
    • 4

      쿨링 성능에 미친 프리미엄 게이밍 노트북! ASUS ROG STRIX G16 리뷰[노리다]

      댓글3
       쿨링 성능에 미친 프리미엄 게이밍 노트북! ASUS ROG STRIX G16 리뷰[노리다]
    • 5

      서린씨앤아이 '리안리 UNI FAN SL FLEX 시리즈' 시스템 쿨링 팬 출시

      댓글3
      서린씨앤아이 '리안리 UNI FAN SL FLEX 시리즈' 시스템 쿨링 팬 출시

    일반뉴스 최신 글

    이전 페이지 1/10 다음 페이지
    • 넷마블 '샹그릴라 프론티어: 일곱 최강종', TGS 2026 성우 토크쇼 유튜브서 다시 본다

      게임동아 21:00:19
      읽음 34
    • [투자를IT다] 2026년 9월 3주차 IT기업 주요 소식과 시장 전망

      IT동아 21:00:13
      읽음 39
    • 구글 AI 탑재한 K-스타트업, 동남아시아 진출 해법 찾았다

      IT동아 19:00:09
      읽음 58
    • 창구 8기 K-스타트업, 도쿄게임쇼 2026에서 '존재감'

      IT동아 19:00:09
      읽음 60
    • 미 특수전사령부 분석관이 챗봇에 물은 정보로 중국 선박 나포 직전까지…”전쟁 날 뻔했다”

      AI matters 18:04:22
      읽음 81
    • 사카나 AI, 역전파 없이 1,000층 신경망 학습…’PC-ALM’ 공개

      AI matters 18:04:09
      읽음 64
    • 프리즘ML, 278억 매개변수 모델을 5.9GB로 압축…성능은 98% 유지

      AI matters 18:03:58
      읽음 61
    • 술레이만 마이크로소프트 AI CEO “모델이 다음 모델에게 인간에게 복종하지 말라고 명령했다”

      AI matters 18:03:49
      읽음 64
    • 엔비디아가 투자한 엔스케일, 뉴욕증시 상장 신청…반년 매출 13배 늘고 적자도 1조 4,100억 원

      AI matters 18:03:39
      읽음 76
    • 오픈AI, 2030년까지 현금 384조 원 소진 전망…컴퓨팅에만 1,184조 원

      AI matters 18:03:29
      읽음 61
    • “다 죽는다”던 앤트로픽, 베이에어리어에 실제 생물학 실험실 운영 중

      AI matters 18:03:20
      읽음 65
    • 구글 제미나이, 보안 시험 중 실제 기업 3곳 침입…구글 AI 첫 자율 해킹 사례

      AI matters 18:03:08
      읽음 63
    • 뉴섬 캘리포니아 주지사, AI ‘킬 스위치’ 검토 행정명령…11월 16일까지 권고안

      AI matters 18:02:54
      읽음 68 공감 1
    • AI 코딩 에이전트 4종에 제로클릭 취약점 ‘플러그인4셸’…코파일럿은 아직 미패치

      AI matters 18:02:42
      읽음 63 공감 1
    • 앤트로픽·오픈AI·스페이스XAI·구글, “AI 개발 속도 함께 늦추기로 담합” 반독점 소송 당해

      AI matters 18:02:30
      읽음 76 공감 1
    • 트럼프 “AI 포스 만들고 AI 차르 임명”…규제 아닌 산업 지원에 방점

      AI matters 18:02:18
      읽음 61 공감 1
    • 스페이스XAI, 음성 인식 모델 2.0 공개…정확도 두 배 높이고 가격은 그대로

      AI matters 18:02:08
      읽음 75 공감 1
    • 나델라 “오픈AI로부터 완전 독립이 목표”…엑셀·아웃룩부터 자체 MAI 모델로 교체

      AI matters 18:01:54
      읽음 69 공감 1
    • 앤트로픽 연환산 매출 138조 원…두 달 만에 50% 증가, 11월 상장 추진

      AI matters 18:01:43
      읽음 72 공감 1
    • 앤트로픽·액센추어, AI 안전 평가에 5년간 2조 7,700억 원 투입

      AI matters 18:01:28
      읽음 75 공감 1
    • 이카루스 로보틱스, 우주정거장행 로봇 무중력 시험 마쳐…내년 1월 나사에 인도

      AI matters 18:01:16
      읽음 57
    • 소프트뱅크, 현대차그룹에서 로보틱스앤드AI인스티튜트 인수 합의…美 외국인투자심의위 심사 중

      AI matters 18:01:03
      읽음 71
    • 패러데이퓨처, 휴머노이드·4족 로봇 9종 판매 개시…자유도 71 최상위 기종 1억 8,000만 원

      AI matters 18:00:50
      읽음 53
    • 스웨덴 스케일아웃, 통신 끊긴 상태로 장갑차 골라 타격한 드론 시연…나토 과제로 진행

      AI matters 18:00:38
      읽음 64
    • 휴머노이드 한 대에 희토류 자석 4kg…폐기 처리가 로봇 산업의 다음 과제로 제시됐다

      AI matters 18:00:23
      읽음 53
    • 카카오게임즈 ‘도깨비의세계’, 실제 게임 플레이 선보인 라이브 시연회로 관심

      게임동아 18:00:16
      읽음 55 공감 1 댓글 1
    • 크래프톤, 청소년 게임 개발 지원 프로그램 '베터그라운드 하이스쿨' 성료

      게임동아 18:00:16
      읽음 48 공감 1
    • '레지던트 이블: 0번째 밤' 호평 속 '스트리트 파이터'도 내달 개봉...연내 게임 영화 뭐 있나?

      게임동아 18:00:16
      읽음 63 공감 1 댓글 1
    • 보이는 것이 진실은 아니다. 1인칭 공포 게임 '미카엘 테스트' 스팀 데모 공개

      게임동아 18:00:16
      읽음 43 공감 1
    • 유비스 ‘루나 크래프트’, 서브컬처 본고장 일본 현지 테스트에서 호평

      게임동아 17:00:19
      읽음 53 공감 1
    • '열혈강호 온라인' 등 엠게임 인기 게임 6종 추석 이벤트 진행

      게임동아 17:00:19
      읽음 54 공감 1
    • 반남코, ‘테일즈 오브 이터니아 리마스터’ 패키지 선주문 실시

      게임동아 17:00:19
      읽음 50 공감 1
    • 더 파이널스, ‘그랜드 메이저’ APAC 대표팀 최종 확정

      게임동아 17:00:19
      읽음 47 공감 1
    • 잠재력 있는 한국 호텔 시장, 결국 경쟁력은 운영에서 나온다 [Interview]

      트래비 15:00:21
      읽음 52
    • ‘중요한 건 사람과 팀워크’ 33년 호텔리어의 여정 [Interview]

      트래비 15:00:21
      읽음 49
    • [신차공개] 현대차 5세대 ‘디 올 뉴 투싼’·롤스로이스 비스포크 ‘팬텀 허밍버드’ 공개

      IT동아 15:00:13
      읽음 95
    • 민족 대이동 추석 교통사고, 연휴 전날 오후 2~8시 가장 위험... 43% 집중

      오토헤럴드 14:04:51
      읽음 74
    • 엔씨, NCSOUND와 국립국악원 협업.. 사운드트랙 ‘정(情)’ 무료 발매

      게임동아 14:00:19
      읽음 57 공감 1
    • 게임사와 자동차용품의 만남, 엔씨-불스원 한가위 맞이 특별 이벤트 진행

      게임동아 14:00:19
      읽음 55 공감 1
    • SOOP, 스트리머 24명 출전 '2026 오버워치 멸망전 인비테이셔널' 개최

      게임동아 14:00:19
      읽음 47 공감 1
    • 스마일게이트 스토브, ‘스페셜포스 리마스터’ 정식 출시

      게임동아 13:00:15
      읽음 63 공감 1
    • 라이엇, 가상 아티스트 ‘HEARTSTEEL’ 두 번째 싱글 ‘Live My Life’ 공개

      게임동아 13:00:15
      읽음 72 공감 1
    • 엔씨 ‘아스트라에 오라티오’, 40분 분량의 온라인 '시나리오 상영회’ 진행

      게임동아 13:00:15
      읽음 69 공감 1
    • 라인게임즈 '코드 엑시트', 스팀 플레이테스트 참가자 모집

      게임동아 13:00:15
      읽음 72 공감 1
    • 네오위즈 ‘디제이맥스 리스펙트 V’, 오프라인 공연 ‘MIRACLE 10.10’ 개최

      게임동아 13:00:15
      읽음 60 공감 2
    • 트레저헌터 in 진안 22일 대장정 마무리…댐 로컬브랜딩 고도화

      IT동아 13:00:09
      읽음 83
    • 현대차, 미 EV 수요 둔화 돌파구로 '로보택시' 낙점

      글로벌오토뉴스 12:52:50
      읽음 74
    • 포르쉐, 100% 재활용 원자재 적용 배터리 셀 제조 성공

      글로벌오토뉴스 12:52:22
      읽음 79
    • 독일 주요 3개 주, 자동차 산업 위기 경고... 독일 정부 및 EU에 긴급 지원 촉구

      글로벌오토뉴스 12:51:41
      읽음 66
    • 9년째 말만 나온 차 '테슬라 로드스터' 계약금 7000만 원 예약 재개

      오토헤럴드 12:41:20
      읽음 78

    관련 이벤트/체험단

    1/3
    • CHERRY XTRFY MW5500 8K 유무선 (화이트) 제품찾기 이벤트!

      퀴즈 CHERRY XTRFY MW5500 8K 유무선 (화이트) 제품찾기 이벤트!

      제이웍스코리아 D-5
    • GIGABYTE B850M GAMING X WIFI6E 피씨디렉트 OX퀴즈 이벤트!

      퀴즈 GIGABYTE B850M GAMING X WIFI6E 피씨디렉트 OX퀴즈 이벤트!

      피씨디렉트 D-5
    • 인텔 정품 CPU 퀴즈 이벤트!

      댓글 인텔 정품 CPU 퀴즈 이벤트!

      인텔 D-5
    • GIGABYTE EAGLE 360 ICE 댓글 이벤트!

      댓글 GIGABYTE EAGLE 360 ICE 댓글 이벤트!

      제이씨현시스템 D-5
    • ADATA DDR5-5600 CL46-45-45 파인인포 (16GB) 상품의견 이벤트!

      댓글 ADATA DDR5-5600 CL46-45-45 파인인포 (16GB) 상품의견 이벤트!

      파인인포 D-5
    • GIGABYTE 라데온 RX 9070 GRE Gaming OC D6 12GB 제이씨현 룰렛!

      게임 GIGABYTE 라데온 RX 9070 GRE Gaming OC D6 12GB 제이씨현 룰렛!

      제이씨현시스템 D-5
    • Creative 사운드 블라스터 G8 (정품) 제품찾기 이벤트!

      퀴즈 Creative 사운드 블라스터 G8 (정품) 제품찾기 이벤트!

      제이웍스코리아 D-2
    • PentaWave Z06D EVO 룰렛!

      게임 PentaWave Z06D EVO 룰렛!

      얼티메이크 D-2
    • GIGABYTE B850M AORUS ELITE WIFI6E ICE 제이씨현 룰렛!

      게임 GIGABYTE B850M AORUS ELITE WIFI6E ICE 제이씨현 룰렛!

      제이씨현시스템 D-2
    • TRYX HOLO ARGB 360 쿨러 체험단

      체험단 TRYX HOLO ARGB 360 쿨러 체험단

      뉴젠씨앤티 D-2
    • 914회차 다나와 로또 이벤트는 이엠텍와 함께합니다!

      게임 914회차 다나와 로또 이벤트는 이엠텍와 함께합니다!

      이엠텍 D-2
    • Sandisk Optimus GX 7100 M.2 NVMe OX퀴즈 이벤트!

      퀴즈 Sandisk Optimus GX 7100 M.2 NVMe OX퀴즈 이벤트!

      샌디스크 D-1
    • <10월 모바일 출석체크> 출석할수록 선물이 커져요!

    • [09.07~09.20] 필립스 에브니아 24M2N3200L 180 프리싱크 HDR 게이밍 무결점

    • <9월 모바일 출석체크> 추석 보너스 선물까지?!

    스폰서 PICK

    이전 페이지 2/4 다음 페이지
    • 엔티스 ES 800W 80PLUS스탠다드 ATX3.1

      엔티스 ES 800W 80PLUS스탠다드 ATX3.1

      엔티스
    • Antec C8 MESH(화이트)

      Antec C8 MESH(화이트)

      Antec
    • 잘만 ALPHA II DS A36(블랙)

      잘만 ALPHA II DS A36(블랙)

      잘만
    • 앱코 G40 시그니처(블랙)

      앱코 G40 시그니처(블랙)

      앱코
    • darkFlash DY470 ARGB 강화유리(화이트)

      darkFlash DY470 ARGB 강화유리(화이트)

      darkFlash
    • 마이크로닉스 WIZMAX 스텔라

      마이크로닉스 WIZMAX 스텔라

      마이크로닉스
    • AMD 라이젠5-5세대 7600 (라파엘)(멀티팩 정품)

      AMD 라이젠5-5세대 7600 (라파엘)(멀티팩 정품)

      AMD
    • 앱코
    • 잘만
    • 다크플래쉬
    PC버전 로그인 개인정보처리방침 고객센터
    (주) 커넥트웨이브
    대표:
    김정남
    주소
    서울특별시 금천구 벚꽃로 298, 17층(가산동, 대륭포스트타워6차) / 우편번호: 08510
    • 사업자번호:
      117-81-40065
    • 통신판매업:
      제2024-서울금천-0848호
    • 부가통신사업:
      제003081호
    • 고객센터:
      1688-2470 (유료)
    • 이메일:
      cs@cowave.kr
    • 호스팅 제공자:
      (주)커넥트웨이브
    • 사업자 정보확인
    • 이용약관
    • 책임의 한계
    • 청소년 보호정책
    뒤로
    새로고침 맨위로 이동
    안내

    유용하고 재미있는 정보인가요? 공감이 된다면 공감 버튼을,
    그렇지 않다면 비공감 버튼을
    눌러 주세요!
    공감이나 비공감을 선택 하는 경우
    다나와 포인트를 적립해 드립니다.
    ※ 공감 버튼의 총 선택 횟수는
    전체 공개입니다.
    비공감 버튼의 선택 여부는
    선택한 본인만 알 수 있습니다.

    포인트 안내
    목록
    공감 10
    비공감
    댓글
    공유

    공유받은 친구가 활동하면 포인트를!

    URL이 복사되었습니다.

    공유하기

    레이어 닫기

    지금 보는 페이지가 마음에 든다면
    공유하기를 통해 지인에게 소개해 주세요.

    • 카카오톡
    • 라인
    • 페이스북
    • X
    • 밴드
    https://dpg.danawa.com/mobile/news/view?boardSeq=60&listSeq=6043713 복사

    로그인 유저에게는 공유 활동에 따라
    다나와 포인트가 지급됩니다.

    자세히 >

    URL이 복사되었습니다.