로그인하세요
알림
설정
레프트패널 닫기
관심
최근본
마이페이지
출석체크
카테고리
    서비스 바로가기
    • 자동차
    • 인기 서비스조립PC
    • PC견적
    • PC26
    • 신규 서비스LIVE쇼핑
    • 커뮤니티
    • 이벤트
    • CM추천/문의
    • 오늘의 특가
    앱 서비스
    • 자동차
    • PC견적
    • 장터
    인기 쇼핑몰
    • 지마켓
    • 쿠팡
    • 옥션
    • 11번가
    • LG전자
    • 하이마트
    • 전자랜드
    • 롯데아이몰
    • SSG
    • CJ 온스타일
    • GS샵
    • 롯데닷컴(롯데온)
    • 현대Hmall
    • 이마트몰
    • SK스토아
    • 더현대닷컴
    • 엘롯데
    • 신세계몰
    • NS몰
    • 홈플러스
    • 공영쇼핑
    • 홈앤쇼핑
    • 신세계 라이브쇼핑
    • 오늘의 집
    • 배민상회
    • 동원몰
    • LF몰
    • ZETTA몰
    PC버전 로그인 개인정보처리방침 고객센터
    (주) 커넥트웨이브
    대표:
    김정남
    주소
    서울특별시 금천구 벚꽃로 298, 17층(가산동, 대륭포스트타워6차) (우) 08510
    • 사업자번호:
      117-81-40065
    • 통신판매업:
      제2024-서울금천-0848호
    • 부가통신사업:
      제003081호
    • 고객센터:
      1688-2470 (유료)
    • 이메일:
      cs@cowave.kr
    • 호스팅 제공자:
      (주)커넥트웨이브
    • 사업자 정보확인
    • 이용약관
    • 책임의 한계
    • 청소년 보호정책
    사용법 보기
    MY쇼핑이란? 자주 쓰는 쇼핑몰을 연결하면 쇼핑몰 주문내역을 한 번에 확인할 수 있습니다. 쇼핑몰 계정은 고객님의 핸드폰에만 저장되어 안전합니다.
    편리한 구매내역 확인. 다양한 쇼핑몰의 주문내역을 한 곳에서 확인해보세요.
    가격비교와 최저가 쇼핑을 한 번에. 자주 구매하는 상품은 가격비교를 통해 저렴하게 구매하세요.
    보안은 필수! 쉽고 편한 가치 쇼핑. 쇼핑몰 계정은 고객님의 핸드폰에만 암호화 저장되어 안전합니다. 쇼핑몰 연결
    다나와 홈

    커뮤니티 DPG

    일반뉴스

    • 게시판
    • 상품포럼
    • 뉴스
    • 동영상
    • 커뮤니티 공지사항
      소비자사용기
    • 특가몰
      자유게시판
    • 이달의 이벤트
      유머게시판
    • 당첨자발표게시판
      댕냥이게시판
    • 포인트 마켓
      Q&A게시판
    • 다나와 래플
      상품의견
    • 모두의 경매
      체험단
    • 오늘도 출석체크
      엄근진게시판
    • 입소문쇼핑
      쇼핑몰후기
    • 메인가자
      A/S후기
    • 당첨후기
    • 컴퓨터
      AI
    • 푸드
      취미
    • 최신뉴스
      일반뉴스
    • 기획뉴스
      신상품뉴스
    • 쇼핑뉴스
      테크팁
    • 다나와리포터
      구매가이드
    • 전문가리뷰
      인기순위가이드
    • 벤치마크
      차트뉴스
    • 가격동향
    • 고나고
      공구왕황부장
    • 노써치
      도레
    • 딴트공 말방구 실험실
      라이브렉스
    • 맛상무
      모터피디
    • 무적풍화륜
      민티저
    • 보드나라
      뻘짓연구소
    • 여행매거진 트래비TV
      오토기어
    • 조코딩 JoCoding
      인프제 INFJ
    • 주연 ZUYONI
      진블로그
    • 집마 홀릭TV
      톡써니
    • 포마: 탈 것을 리뷰하는 남자
      쿨엔조이
    • 훅간다TV
      AI 매터스
    • Allthatboots TV
      DmonkTV
    • Hakbong Kwon
      Motorgraph
    • PC SNAP
      Producer dk
    • THE EDIT
      UnderKG
    • 다나와 공식채널
      답나와
    • 리뷰나와
      샵다나와 조립갤러리
    >
    이전 글
    다음 글
    IT동아

    독자 AI 파운데이션 2차 평가 임박··· 각 모델 별 기술로 살펴본 승부수는?

    2026.08.07. 02:19:41
    읽음87

    [IT동아 남시현 기자] 2025년 8월 시작된 ‘독자 AI 파운데이션(이하 독파모)’ 사업이 2차 평가를 눈앞에 두고 있다. 독파모 사업은 해외 거대 AI 모델 의존에서 벗어나 한국만의 AI 주권을 확보하고, 국내 산업 인프라 및 AI 생태계 지원을 목표로 시작했다. 1차 평가에서는 모델의 독자성과 언어모델의 구성을 집중적으로 검증했으며 업스테이지, LG AI 연구원, NC AI, 네이버클라우드, SK텔레콤 중 NC AI, 네이버클라우드 두 개 기업이 고배를 마셨다. 이후 2차 평가에서는 모티프테크놀로지가 기술 독자성을 인정받아 새롭게 합류했으며 6개월 간의 여정을 마치고 이제 막 평가를 기다리는 상황이다.

    독자 AI 파운데이션 사업은 5개 컨소시엄으로 시작해 2개가 탈락하고, 다시 1개 컨소시엄이 합류해 현재 4파전을 벌이고 있다. 8월 중에 1개 컨소시엄이 탈락하고 올해 12월 중 추가로 탈락해 2개만 남는다 / 출처=제미나이 이미지 생성
    독자 AI 파운데이션 사업은 5개 컨소시엄으로 시작해 2개가 탈락하고, 다시 1개 컨소시엄이 합류해 현재 4파전을 벌이고 있다. 8월 중에 1개 컨소시엄이 탈락하고 올해 12월 중 추가로 탈락해 2개만 남는다 / 출처=제미나이 이미지 생성

    우리 정부는 글로벌 프런티어 모델의 95%에 가까운 성능을 달성할 것을 목표로 설정했으며, 1차 평가에서 언어 모델 2차 평가에서 멀티모달 모델, 3차 평가에서 액션 모델로 구체적인 모델 구성을 잡았다. 이에 따라 2차 평가는 대형언어모델의 성능뿐만 아니라 산업 현장에서 에이전트 AI 활용 방안, 그리고 텍스트, 이미지, 비디오 등 다양한 형태의 데이터를 동시에 인식하고 결합하는 멀티모달 기술의 성능 평가를 집중적으로 진행할 예정이다. 보고서 및 제출이 완료된 현재 시점에서 공개된 기술 보고서와 정보를 조합해 각 모델 구성을 살펴봤다.

    업스테이지 솔라 오픈 2, AI 에이전트 성능 대폭 강화

    업스테이지의 솔라 오픈 2, 총 2500억 개의 매개변수가 적용됐다 / 출처=업스테이지
    업스테이지의 솔라 오픈 2, 총 2500억 개의 매개변수가 적용됐다 / 출처=업스테이지

    업스테이지 솔라 오픈 2는 전작의 1020억 개 매개변수를 두 배 이상인 총 2500억 개(250B)로 구성한 모델이다. 실제 연산 시에는 150억 개 수준의 연산량만 활용하며, 한 번에 100만 개의 토큰을 처리할 수 있어 길고 복잡한 AI 에이전트도 맥락을 벗어나지 않고 한 번에 다룬다. 또한 이전 모델에서 약 2.3%에 해당하는 핵심 가중치를 재사용해 학습 시간을 크게 줄었고, 한국어 입력 시 토큰 효율성을 더 끌어올렸다. 아울러 2차 평가 기준인 에이전트 성능 확보를 위해 대화형 도구 사용, 코딩 및 사무 업무를 포괄하는 에이전트 시나리오를 학습했다.

    솔라 오픈 2와 오픈 1, 딥시크 V4 플래시 및 미모-V4, GPT 5.4 미니와의 성능 비교 / 출처=업스테이지
    솔라 오픈 2와 오픈 1, 딥시크 V4 플래시 및 미모-V4, GPT 5.4 미니와의 성능 비교 / 출처=업스테이지

    성능 측면에서는 지식 및 과학 추론, 수학, 코딩, 지시 이행, 한국어 종합 성능이 전반적으로 크게 향상됐다. 기존에 솔라 오픈 100B에서 축적된 자료와 학습 경험을 바탕으로 새로운 아키텍처를 구성한 덕분이다. 박사 급 과학분야 추론 문제 198개로 구성된 GPQA-다이아몬드 테스트에서는 1세대 정확성이 66.2%이었는데 86.3%로 크게 올랐다. 라이브 벤치 v6 성능도 56.5%에서 92.4%로 대폭 향상됐으며, 올림피아드 급 수학 문제로 구성된 AIME2026도 87.7%에서 95.7%로 정확도를 높였다. 전반적인 성능은 글로벌 프론티어 급인 딥시크-V4 플래시 284-A13B 모델 수준이다.

    특히 전 세대에서 부족했던 AI 에이전트 성능은 괄목할 만큼 성장했다. 사실 이전 모델에서 AI 에이전트는 평가 기준이 아니어서 상대적으로 소홀한 면이 있었다. 자율소프트웨어 역량 벤치마크인 SWE-벤치는 전세대가 15.4%였는데 이번에 70.4%로 크게 올랐고, 격리된 가상의 터미널 환경에서 작업 역량을 확인하는 터미널 벤치 하드 테스트도 2.3%에서 28.3%으로 올랐다. 총 45가지 주제에 걸쳐 3만 5030개의 전문가 질문이 다지선다형으로 구성된 한국어 AI 성능 평가 지표인 KMMLU-프로는 78.4점으로 전작의 64.02점보다 높아졌다.

    AI 양자화 기술 기업 노타가 솔라 오픈 2를 양자화해 요구 메모리를 160GB 이하로 줄여 활용성을 크게 높였다 / 출처=노타
    AI 양자화 기술 기업 노타가 솔라 오픈 2를 양자화해 요구 메모리를 160GB 이하로 줄여 활용성을 크게 높였다 / 출처=노타

    주목할만한 부분은 하드웨어 요구사항이다. 최소 사양은 엔비디아 H200 4장, 권장 사양은 8장으로 온프레미스 조건은 중견기업은 되어야 할 만 하다. 업스테이지는 AI 모델 양자화 기술 기업 노타와의 협업으로 4비트 양자화에 전역 가지치기를 적용한 경우 모델 규모를 H100 2 장에서 구동 가능한 137.8GB로 크게 줄였다. 엔비디아 블랙웰 이상에서 지원하는 NVFP4 조건에서는 블랙웰 B200 1장으로도 구동할 수 있다. 덕분에 데이터서버용 그래픽 카드 수급이 어려운 조건은 물론 온프레미스 환경, 폐쇄망에서까지도 솔라 오픈 2를 무난하게 쓸 수 있다.

    SK텔레콤, 고성능 에이전트에 688B 결합한 A.X K2 공개

    SK텔레콤의 A.X K2 로고. 전작 대비 매개변수는 1690억 개 늘리면서 학습 방식을 바꿔 성능과 효율을 높였다 / 출처=SK텔레콤
    SK텔레콤의 A.X K2 로고. 전작 대비 매개변수는 1690억 개 늘리면서 학습 방식을 바꿔 성능과 효율을 높였다 / 출처=SK텔레콤

    A.X K2는 5190억 개 매개변수가 적용된 A.X K1의 후속 모델로 총 6880억 개 매개변수가 적용됐다. 멀티모달 부분을 고려해 A.X K2 메인 모델 이외에도 이미지를 분석하는 A.X K2 VE, 음향 부분에 대응하는 A.X K2 ALM, 음성 모델인 A.X K2 Raon-Speech가 함께 출시됐다.

    전작과 동일하게 전문가 모델 활성 매개변수는 330억 개지만 전문가 구조가 192명 전문가 및 주력 1명 구조에서 256명 및 1명으로 업그레이드됐다. 콘텍스트 길이는 13만 토큰 수준에서 26만 토큰으로 두 배 가량 늘었다. A.X K1의 아키텍처는 추론 시 발생하는 KV 캐시를 저 차원 잠재 영역으로 압축해서 저장하는 멀티 헤드 잠재 어텐션(MLA)으로 요구 메모리를 효율화했는데, A.X K2는 MLA에 불필요한 토큰 집중 연산을 줄이는 희소 어텐션과 정보 필터링 및 안정성을 끌어올린 게이티드 어텐션을 결합한 희소 게이티드 어텐션을 추가로 적용해 AI 에이전트 실행을 위한 문맥 추론 길이는 늘리고 속도와 안정성을 확보했다.

    A.X K2와 글로벌 프런티어 모델과의 주요 성능 비교 / 출처=SK텔레콤
    A.X K2와 글로벌 프런티어 모델과의 주요 성능 비교 / 출처=SK텔레콤

    성능은 GPQA-다이아몬드가 85.6%며, AIME 2026은 97.1%로 우수한 지능 점수를 보여줬다. 라이브 벤치 v6는 84%로 1세대의 74.9%에 비하면 올랐지만 매개변수가 절반 정도인 3970억 개에 170억 개 전문가 모델이 동작하는 큐웬 3.5의 82.6%와 크게 다르지 않아 아쉽다. 한국어 성능을 확인하는 KMMLU-프로는 전작이 68.9점이었으나 80.5점으로 크게 높였다.

    주목할만한 점은 모델 크기가 크다보니 학습 방식을 FP8 혼합정밀도에서 네이티브 MXFP8로 변경했다. 1세대 모델은 메인 매개변수는 FP32, BF16으로 관리하며 학습 중 FP8 연산을 활용하는 방식이었지만, 2세대 모델은 배포파일 자체를 FP8로 저장하는 MXFP8로 전환함과 동시에 데이터를 32개 수준의 더 작은 블록 단위로 조절해 수치 손실을 줄이고 정밀도를 높였다. MXFP8은 글로벌 서버 표준을 제정하는 오픈 컴퓨트 프로젝트(OCP)에서 제정한 표준이고, 엔비디아 블랙웰에서 텐서코어 레벨에서 처리되므로 향후 확산 시 활용 가치가 높다.

    누구나 이용할 수 있는 아파치 2.0 라이선스로 배포돼 AI 생태계 침투력을 크게 높였다 / 출처=허깅페이스
    누구나 이용할 수 있는 아파치 2.0 라이선스로 배포돼 AI 생태계 침투력을 크게 높였다 / 출처=허깅페이스

    다만 MXFP8로 요구 메모리를 절반이나 줄였음에도 불구하고 활성 용량이 647 GiB(기비바이트), KV 캐시 및 활성화를 포함하면 800 GiB의 막대한 GPU 메모리가 필요하다. 검증에는 4개의 엔비디아 B300 카드가 활용됐는데 엔비디아 H100으로 환산하면 12장 이상이 필요한 수준이다. 긍정적인 점은 라이선스가 아파치 2.0으로 배포돼 상업적 이용, 수정, 재배포가 모두 가능하다. 소규모 스타트업들도 A.X K2, VE를 기반으로 서비스를 제작하고 만들어도 무방하다. 대신 ALM은 비상업적-연구 용도로만 쓸 수 있고, 라온 스피치는 저작자 표시 및 비상업 용도로만 쓸 수 있다.

    LG AI 연구원, 3배 커진 749B K-EXAONE 2.0으로 승부수

    LG AI 연구원의 2세대 모델은 K-EXAONE 2.0 주요 변경점 / 출처=LG AI 연구원
    LG AI 연구원의 2세대 모델은 K-EXAONE 2.0 주요 변경점 / 출처=LG AI 연구원

    LG AI 연구원의 K-EXAONE 2.0은 전작 대비 매개변수를 3.2배 키운 7490억 개 초대형 모델로 승부수를 띄웠다. 아키텍처는 기존의 희소성 MoE 모델에 레이어를 48에서 78로 올리고, 동원 전문가는 256으로 늘린 뒤 매개변수를 236B에서 749B로 확장한 구조다. 모델 크기가 커지다보니 추론 가속을 위해 DSpark라는 선택지가 새롭게 도입된다. 1세대 모델은 사전 모델이 초안 단어를 만든 뒤 주력 모델이 일괄 검수하는 다중 토큰 예측(MTP)만 사용됐는데, 2세대는 별도로 학습된 모듈이 7개 토큰 크기의 블록을 한 번의 연산으로 초안을 찍어내는 DSpark 레이어 활용 버전을 추가해 초당 토큰 생성 속도를 1.81배에서 최대 2.57배 늘렸다.

    장문맥 탐색 및 추론 성능, 지시 준수 및 안정성 점수는 크게 올랐으나 전반적인 지식 성능은 거의 비슷했다. 실제 환경 에이전트 과제 성능은 3세대 모델에서 해결해야할 숙제로 남았다 / 출처=LG AI 연구원
    장문맥 탐색 및 추론 성능, 지시 준수 및 안정성 점수는 크게 올랐으나 전반적인 지식 성능은 거의 비슷했다. 실제 환경 에이전트 과제 성능은 3세대 모델에서 해결해야할 숙제로 남았다 / 출처=LG AI 연구원

    다만 매개변수를 세배나 높인 것에 비해 벤치마크 점수가 크게 높아지지 않았다. GPQA-다이아몬드는 전작이 79.1%에서 82.2%로 소폭 올랐고, AIME2026은 전작의 92.2%에서 0.1% 오른 92.3%로 큰 차이가 없었다. KMMLU-프로는 전작이 67.3점이었는데 69.1로 오름폭이 적었다. 오히려 매개변수가 330억 개로 구성된 엑사원 4.5가 AIME 2026이 92.6점, KMMLU-프로가 67.6점임을 감안하면 기대했던 만큼 성능이 나오진 않는다. 기술 보고서에서는 지표 향상보다는 에이전틱 코딩, 초장문 맥락 이해, 도구 사용 등 실무 서빙에 필요한 핵심 역량 향상에 집중했다고 서술했다.

    실제 성능 향상은 AI 코딩 및 에이전트 벤치마크 세 종에서 약 30%의 성능 향상을 기록했으며, 최대 지원 콘텍스트의 길이는 25만 6000토큰으로 유지하면서 효율을 크게 끌어올린 점을 강조한다. 토큰 윈도우 크기를 의미하는 슬라이딩 윈도우 크기는 기존에는 일률적으로 128으로 고정했으나 새 버전에는 두 번째 레이어를 적용해 크기를 4096으로 넓혀 초반 문맥 수용력을 넓혔고, 사전 학습 이후 중간 단계에서 추가로 학습하는 미드 트레이닝을 추가해 장문 추론 추적, 에이전트 실행 이력 확인 성능 등을 높였다. 덕분에 긴 문맥 속에서 여러 위치에 흩어진 정보를 찾아 연계하는 오픈AI-MRCR 점수는 52.3점에서 94.4점으로 대폭 향상됐다.

    좌측이 K-EXAONE 2.0의 메인 모델 아키텍처, 우측 상단이 다중토큰예측(MTP) 모듈, 하단이 DSpark 모듈 구조다 / 출처=LG AI 연구원
    좌측이 K-EXAONE 2.0의 메인 모델 아키텍처, 우측 상단이 다중토큰예측(MTP) 모듈, 하단이 DSpark 모듈 구조다 / 출처=LG AI 연구원

    매개변수가 크다보니 하드웨어 요구 성능도 높다. 일단 A.X K2와 마찬가지로 다중 토큰 예측을 활용하고, MTP 대신 5개의 DSpark 레이어를 적용한 별도 모델도 공개해 추론 속도는 솔라 오픈 2나 모티프 3보다 빠를 것으로 예상된다. BF16으로 구동 시 하드웨어는 8개의 H200으로 구성된 노드 두 개, 즉 H200 16개가 필요하다. FP8 환경이면 귄장 VRAM이 가중치 750GB에 KV캐시를 포함해 900GB 수준으로 H200 8개가 필요하다. 엔비디아 블랙웰 B200을 활용하면 권장 VRAM을 500GB까지 줄여 4대의 B200으로도 충분하다.

    퓨리오사AI가 1세대 모델인 K-EXAONE-236B 모델을 자사의 AI 가속기인 RNGD(레니게이드)에서 NVFP4로 구동할 수 있는 모델을 허깅페이스에 업로드했다 / 출처=허깅페이스
    퓨리오사AI가 1세대 모델인 K-EXAONE-236B 모델을 자사의 AI 가속기인 RNGD(레니게이드)에서 NVFP4로 구동할 수 있는 모델을 허깅페이스에 업로드했다 / 출처=허깅페이스

    하드웨어 요구 사항이 이례적으로 높긴 하나 퓨리오사AI의 NPU RNGD가 해답이 될 수 있다. 퓨리오사AI는 지난 7월 1세대 모델인 K-EXAONE-236B-A23B를 NVFP4로 구동하는 모델을 업로드했다. 해당 모델이 4장의 RNGD 카드만으로 구동되는 점을 감안하면 아키텍처를 유지하며 매개변수를 3배로 늘린 2세대 모델은 약 12장 정도면 구성할 수 있을 것으로 추정된다. NVFP4용 엔비디아 B200의 개별 제품 단가와 전력효율을 고려하면 GPU 대비 약 25~30%의 총소유비용과 6배 적은 소비전력으로도 K-EXAONE 2.0를 활용할 수 있을 것이다.

    모티프 3, 자체 기술로 글로벌 프런티어급 성능 달성

    모티프테크놀로지스의 모티프-3는 현재 베타 버전으로 등록돼있다. 조만간 공식 버전이 출시될 전망이다 / 출처=허깅페이스
    모티프테크놀로지스의 모티프-3는 현재 베타 버전으로 등록돼있다. 조만간 공식 버전이 출시될 전망이다 / 출처=허깅페이스

    모티프는 컨소시엄에 가장 마지막으로 참여한 만큼 허깅페이스 상에는 모티프 3 베타 버전만 공개했으며 지난 4일 정보통신산업진흥원에 모티프 3 및 성과보고서를 제출한 것으로 알려졌다. 모티프 3는 오픈소스 아키텍처를 사용하지 않고 모티프 테크놀로지스가 완전히 독자적으로 설계한 모델이며, 총 3140억 개의 매개변수와 130억 개의 활성 매개변수를 갖췄다. 모티프 3는 전문가는 384개, 공유 전문가는 1개로 전문가당 매개 변수를 0.8B로 매우 작게 쪼갰고, 토큰당 활성 전문가는 8개를 배치했다. 결과물이 더 세밀하고 유연하게 나올 수 있는 구조다.

    모티프-3는 베타 버전으로도 아티피셜 애널리시스의 지능 테스트에서 44점을 획득하는 등 우수한 성능을 보여줬다 / 출처=아티피셜애널리시스
    모티프-3는 베타 버전으로도 아티피셜 애널리시스의 지능 테스트에서 44점을 획득하는 등 우수한 성능을 보여줬다 / 출처=아티피셜애널리시스

    또한 그룹화 차분 잠재 어텐션(GLDA)이라는 구조도 적용했다. GLDA는 문맥상 관련이 적은 단어를 줄이는 차분 어텐션, KV캐시를 벡터로 압축해 메모리를 줄이는 잠재 어탠션, 두 어텐션을 활용할 때 병렬 처리 및 자원 할당 등을 관리하는 그룹화 작업을 엮은 기술로 메모리 효율과 추론 속도는 높이는 기술이다. 모티프가 올해 2월 합류해 30여 명의 인원과 700장의 GPU만으로 학습했음을 감안하면 구조의 독창성이나 완성도가 매우 우수한 편이다.

    구체적인 요구 GPU 사양은 공개되지 않았으나 테스트는 엔비디아 H200 및 B200에서 처리되었으며 vLLM을 활용했을 때 8대의 GPU를 데이터 병렬화로 구성한 것을 고려하면 H200 8장 정도는 필요할 것으로 예상된다. 모델 자체는 BF16으로 구성되어 향후 모델 양자화시 요구 하드웨어 사양은 더 줄어들 수 있다. 8비트 양자화는 텐서가 아닌 블록 단위로 가능하고, 4비트 양자화는 시험 단계라고 밝히고 있다.

    모티프-3 베타 버전의 GPQA-다이아몬드 테스트 정확성은 87%, 터미널-벤치 v2.1도 71%로 높게 확인된다 / 출처=아티피셜애널리시스
    모티프-3 베타 버전의 GPQA-다이아몬드 테스트 정확성은 87%, 터미널-벤치 v2.1도 71%로 높게 확인된다 / 출처=아티피셜애널리시스

    베타 버전이 아닌 정식 버전 출시 시점에는 모델 양자화나 구체적인 성능 등이 공개될 예정이다. 한편 모티프 3는 정식 버전이 아님에도 불구하고 글로벌 AI 벤치마크 기관인 아티피셜 애널리시스의 지능지수 검증에서 44점을 획득했다. 해당 항목에서 확인할 수 있는 GPQA-다이아몬드 정확성은 87%, 터미널 벤치 2.1 버전은 71%다. K-EXAONE 2.0이 각각 82.2%, 43.8%인 점을 감안하면 예상 수준을 상회하는 성능이며 정식 버전에서는 점수가 더 향상될 여지가 있다.

    오는 8월 11일까지 국민참여단 평가··· 이후 4팀 중 3팀만 생존

    모티프까지 모델 전달을 완료하면서 독자 AI 파운데이션 2차 평가가 곧 시작된다. 정부는 오는 8일부터 11일까지 일반 국민 200명이 참여하는 국민평가단을 운영한다. 각계각층으로 구성된 200명의 평가단이 4개 AI 모델을 직접 사용한 뒤 절대평가 방식으로 채점한다. 2차 결과는 해당 기준과 벤치마크 평가, 그리고 전문가 평가 점수를 종합한 뒤 12일 이후에 윤곽을 드러낼 예정이다. 2차 평가를 거치면 4개 팀 중 하나 팀이 탈락하고, 올해 연말에 최종 평가를 통해 두 개 팀만 남게 된다.

    정부가 요구하는 AI 모델의 핵심은 단순 지표가 아닌 AI 에이전트, 즉 현실에서의 활용 가치다. 제시한 모델을 얼마나 산업적 가치로 승화시키는가가 선정의 관건이 될 전망이다 / 출처=LG AI 연구원
    정부가 요구하는 AI 모델의 핵심은 단순 지표가 아닌 AI 에이전트, 즉 현실에서의 활용 가치다. 제시한 모델을 얼마나 산업적 가치로 승화시키는가가 선정의 관건이 될 전망이다 / 출처=LG AI 연구원

    각 기업 모델의 주요 특징과 기술 보고서만으로는 AI 모델의 성능이나 실용성 등은 예측할 수 없다. 2차 평가의 기준은 AI 에이전트의 수행 능력과 산업 현장의 적용성, 개방성, 생태계 확장성 등을 종합적으로 평가하며 이는 라이선스나 벤치마크 상으로는 확인할 수 없다. 또한 모델의 서빙 속도나 이용 비용 등 기술 외적인 부분도 고려하지 않을 수 없다. 실제로 모델 성능이나 지능은 높아도 토큰 생성 속도가 느려서 활용성이 부족한 경우도 있고, 반대로 모델 크기 대비 AI 에이전트 성능이 기대 이상인 모델들도 많다. 2차 평가에서 실제로 국민들이 AI를 써보는 평가가 들어간 이유다.

    배경훈 정보통신부장관은 지난 7월 열린 2026 하반기 업무보고 과정에서 ‘독파모 2차 평가가 나오면 기존 3위를 넘어 2위권에도 도전해볼 수 있을 것’이라며 기대감을 나타냈다. 당장 모티프가 700여 장의 B200만으로 세계적 수준의 모델을 만든 점을 감안하면 정부의 전폭적인 지원을 통해 더 큰 결과도 창출해 낼 여력이 있다. 지난 6개월 간의 개발 여정은 이제 마무리되었고 그 결과만을 남겨두고 있다. 남은 것은 기다림 뿐이다.

    IT동아 남시현 기자 (sh@itdonga.com)

    안내 ?

    말 많은 뉴스

    • 1

      다나와-아정당, 생활서비스 제휴 본격화…인터넷·렌탈·휴대폰 비교·가입 서비스 오픈

      댓글30
      다나와-아정당, 생활서비스 제휴 본격화…인터넷·렌탈·휴대폰 비교·가입 서비스 오픈
    • 2

      안 쓰는 폰으로 와이파이 증폭기 만들기

      댓글27
      안 쓰는 폰으로 와이파이 증폭기 만들기
    • 3

      혼수, 새 집 가전·가구 고민하지 말고 한 번에! LGE.COM 홈스타일 패키지 총정리

      댓글26
      혼수, 새 집 가전·가구 고민하지 말고 한 번에! LGE.COM 홈스타일 패키지 총정리
    • 4

      갤럭시 워치9 살까 말까? 워치8 유저가 직접 비교해 보니...

      댓글24
      갤럭시 워치9 살까 말까? 워치8 유저가 직접 비교해 보니...
    • 5

      [정보/루머] 차세대 제온에 하이퍼스레딩 부활시키려는 인텔 및 코어 설계 올스타전 시전한 AMD 등

      댓글22
      [정보/루머] 차세대 제온에 하이퍼스레딩 부활시키려는 인텔 및 코어 설계 올스타전 시전한 AMD 등

    일반뉴스 최신 글

    이전 페이지 1/10 다음 페이지
    • 같은 실수를 반복하던 AI, ‘오답노트’ 200개 쌓자 합격률이 62%에서 85%로 뛰었다

      AI matters 02:19:46
      읽음 77 공감 3
    • [리뷰] 데브시스터즈를 살릴 새로운 돌파구 될까? 쿠키런 방치형 신작 '쿠키런 크럼블'

      게임동아 02:19:45
      읽음 79 공감 3
    • 이용자 피드백으로 완성되는 ‘재의 왕국’, ‘신데리아’ 이스다라 리워크 업데이트 즐겨보니

      게임동아 02:19:44
      읽음 70 공감 3
    • 독자 AI 파운데이션 2차 평가 임박··· 각 모델 별 기술로 살펴본 승부수는?

      IT동아 02:19:41
      읽음 86 공감 3
    • 웹젠, 2026년 상반기 매출 774억 달성... "하반기 신작 대거 선보일 것"

      게임동아 02:19:40
      읽음 68 공감 3
    • [나노 TIP] 물 건너 넘어온 서브컬처 ‘히간: 이루실’ 초반 성장 가이드

      게임동아 02:19:40
      읽음 72 공감 3
    • ‘넥슨 리플레이’, 대구디지털혁신진흥원과 업무협약 체결

      게임동아 02:19:38
      읽음 75 공감 3
    • ‘서든어택’ 서비스 21주년 기념, ‘UP투게더’ 업데이트

      게임동아 02:19:38
      읽음 68 공감 3
    • "이것이 결국 당신의 뜻입니까!" 던파, ‘미카엘라’레이드' 업데이트

      게임동아 02:19:37
      읽음 66 공감 3
    • [가이드] 4명의 캐릭터가 만들어가는 액션의 다양성. ‘신데리아’

      게임동아 02:19:37
      읽음 73 공감 3
    • 레드랩게임즈, '롬' 코스튬&가디언 소환 개편 업데이트

      게임동아 02:19:36
      읽음 69 공감 3
    • 한국어도 추가, 스듀풍 신작 필드 오브 미스트리아 정식 출시

      게임메카 02:19:34
      읽음 66 공감 3
    • [위클리_피지컬AI] 피지컬 AI 데이터 확보 총력전, 학습 최적화 고민도 이어져

      IT동아 02:19:33
      읽음 79 공감 3
    • [IT애정남] 카카오톡 일반 채팅방, 팀채팅방으로 바꾸려면?

      IT동아 02:19:09
      읽음 67 공감 3
    • 벤큐 모니터·마우스 구매하고 포토후기 남기면 네이버페이 증정

      뉴스탭 02:18:44
      읽음 69 공감 3
    • 코지마, 창립 81주년 고객 감사전…안마기기 최대 66% 할인

      뉴스탭 02:18:43
      읽음 59 공감 3
    • 부산서만 먹던 ‘돼지국밥짬뽕’ 전국으로…홍콩반점, 딱 2주 한정 판매

      뉴스탭 02:18:42
      읽음 58 공감 3
    • “한 번만 뿌려도 시원하게”…SHIRO, 여름 한정 ‘SALT & WAVES’ 출시

      뉴스탭 02:18:42
      읽음 54 공감 3
    • “방학은 짧아져도 삼시세끼는 그대로”…학부모 집밥 부담 덜어줄 제품은?

      뉴스탭 02:18:41
      읽음 64 공감 3
    • 45주년 맞은 다향, 훈제오리 100g 더 담았다…9월까지 한정 판매

      뉴스탭 02:18:40
      읽음 57 공감 3
    • 샌디스크, AI 인프라 ‘메모리 장벽’ 넘는다…HBF·BiCS10 NAND 공개

      뉴스탭 02:18:39
      읽음 67 공감 3
    • 잠실에 ‘포켓몬 별빛낙원’ 열린다…12m 잉어킹 수로부터 한정 굿즈까지

      뉴스탭 02:18:39
      읽음 65 공감 3
    • “소파도 옷처럼 갈아입는다”…알로소, 최대 10년 보증 ‘평생케어’ 캠페인

      뉴스탭 02:18:38
      읽음 54 공감 3
    • 상담 전화에서 무심코 말한 이름과 주소, AI가 90% 잡아낸다… 가짜 대화 1,600건이 만든 역설적 해법

      AI matters 02:18:38
      읽음 62 공감 3
    • [AI와 인간 사이] 12년전 ‘폭망’한 SF영화가 우리의 현실이 되었다. <트랜센던스>

      AI matters 02:18:37
      읽음 65 공감 3
    • 가민, 트레이닝픽스·트레인히로익 인수…코칭·퍼포먼스 데이터 강화

      뉴스탭 26.08.06.
      읽음 87 공감 6
    • 휴가지에서도 스타일은 포기 못해…리조트·도심 아우르는 바캉스룩

      뉴스탭 26.08.06.
      읽음 84 공감 3
    • 악성코드 대신 윈도우 ‘비트로커’…프린터로 몸값 요구서까지 뽑았다

      뉴스탭 26.08.06.
      읽음 95 공감 3
    • 드라이부터 아우스레제까지…나라셀라, 모젤 리슬링 '놀렌 에르벤' 4종 출시

      뉴스탭 26.08.06.
      읽음 76 공감 3
    • 작업화도 ‘정밀 피팅’ 시대…BOA 적용 프리미엄 안전화 잇따라

      뉴스탭 26.08.06.
      읽음 78 공감 3
    • 리본카, 인기 중고차 160여 대 할인…‘팔월이 왔썸머’ 타임딜

      뉴스탭 26.08.06.
      읽음 96 공감 3
    • 고려은단, 트로트 가수 신성과 쇼핑라이브…여름철 건강관리 제품 총출동

      뉴스탭 26.08.06.
      읽음 75 공감 3
    • 김구 발자취부터 근현대사 100년까지…광복절 의미 더할 여행지 4선

      뉴스탭 26.08.06.
      읽음 67 공감 3
    • “불 앞에 서기 힘들다”…폭염에 주목받는 ‘여름 주방가전’

      뉴스탭 26.08.06.
      읽음 86 공감 3
    • 톰, 레드닷 디자인 어워드 2년 연속 수상…‘투앤티업·더 부스터’ 본상

      뉴스탭 26.08.06.
      읽음 81 공감 3
    • F5, 엔비디아 네모 가드레일과 통합…AI 앱 프롬프트·응답을 한곳에서 검사한다

      AI matters 26.08.06.
      읽음 78 공감 3
    • 애피어, ‘맥스서밋 2026’ 참가…”파편화된 고객 여정 시대, 브랜드 경쟁력은 실시간 실행”

      AI matters 26.08.06.
      읽음 80 공감 3
    • 시놀로지, SK네트웍스서비스 손잡고 국내 영상 보안 시장 공략

      뉴스탭 26.08.06.
      읽음 87 공감 3
    • 캐논코리아, ‘2026 부산국제사진제’ 후원…미래작가 20년 성과 조명

      뉴스탭 26.08.06.
      읽음 80 공감 3
    • 서린씨앤아이, OWC 썬더볼트 독 프로모션 연장…클링온 2개 증정

      뉴스탭 26.08.06.
      읽음 83 공감 3
    • 1960~70년대 명차의 색을 다시 입다…애스턴마틴 '헤리티지 에디션' 5종 공개

      뉴스탭 26.08.06.
      읽음 71 공감 3
    • [순정남] 인간의 마음이 없는 거냐! 격투게임 기술 TOP 5

      게임메카 26.08.06.
      읽음 69 공감 3
    • [오늘의 스팀] 역대 최고 동접, 세피리아 연일 상승세

      게임메카 26.08.06.
      읽음 71 공감 3
    • 멧챠 카멜레온 사물 버전, 숨바꼭질 신작 '페이크 미' 공개

      게임메카 26.08.06.
      읽음 69 공감 3
    • 웹게임으로 옮긴 고전 플래시 게임, 다시금 진화 중

      게임메카 26.08.06.
      읽음 78 공감 3
    • AI 에이전트 시대, 왜 ‘AI 레드티밍’은 필수 조건이 되었나

      IT동아 26.08.06.
      읽음 86 공감 3
    • 인도자동차공업회, E20 에탄올 혼합 연료 결함 공식 인정 및 정부 서환 전달

      글로벌오토뉴스 26.08.06.
      읽음 80 공감 3
    • 기름 덜 사기 시작했다… 중국산 전기차가 바꾼 세계 석유 지도

      글로벌오토뉴스 26.08.06.
      읽음 77 공감 3
    • 프랑스 정부, 완성차 및 부품 업계 결합해 연간 6만 대 규모 군용 드론 생산 기반 구축

      글로벌오토뉴스 26.08.06.
      읽음 74 공감 4
    • [영상] 미니멀리즘과 미감의 조화, 2027년형 폴스타 4 쿠페 시승기

      글로벌오토뉴스 26.08.06.
      읽음 82 공감 4

    관련 이벤트/체험단

    1/3
    • Sandisk Optimus GX PRO 850X M.2 NVMe OX 퀴즈 이벤트!

      퀴즈 Sandisk Optimus GX PRO 850X M.2 NVMe OX 퀴즈 이벤트!

      샌디스크 D-4
    • ASUS TUF Gaming B850M-PLUS II STCOM 룰렛!

      게임 ASUS TUF Gaming B850M-PLUS II STCOM 룰렛!

      STCOM D-4
    • 레노버 상품의견 이벤트!

      댓글 레노버 상품의견 이벤트!

      커넥트웨이브 D-4
    • 킹스톤 FURY Renegade G5 M.2 NVMe 댓글 이벤트!

      댓글 킹스톤 FURY Renegade G5 M.2 NVMe 댓글 이벤트!

      코잇 D-3
    • ASUS DUAL 지포스 RTX 5060 Ti OC D7 16GB 코잇 댓글 이벤트!

      댓글 ASUS DUAL 지포스 RTX 5060 Ti OC D7 16GB 코잇 댓글 이벤트!

      코잇 D-3
    • ASUS PRIME B860M-A-CSM 코잇 룰렛!

      게임 ASUS PRIME B860M-A-CSM 코잇 룰렛!

      코잇 D-3
    • GIGABYTE B650M K 피씨디렉트 룰렛!

      게임 GIGABYTE B650M K 피씨디렉트 룰렛!

      피씨디렉트 D-3
    • ADATA LEGEND 900 M.2 NVMe 파인인포 (512GB) 룰렛!

      게임 ADATA LEGEND 900 M.2 NVMe 파인인포 (512GB) 룰렛!

      파인인포 D-3
    • MSI GM51 LIGHTWEIGHT WIRELESS 마우스 체험단

      체험단 MSI GM51 LIGHTWEIGHT WIRELESS 마우스 체험단

      MSI D-3
    • JONSBO TH-360 (화이트) 제품찾기 이벤트!

      퀴즈 JONSBO TH-360 (화이트) 제품찾기 이벤트!

      브라보텍 D-2
    • DEEPCOOL AG620 G2 (블랙) 제품찾기 이벤트!

      퀴즈 DEEPCOOL AG620 G2 (블랙) 제품찾기 이벤트!

      브라보텍 D-2
    • DEEPCOOL LT360 VISION ARGB (블랙) 제품찾기 이벤트!

      퀴즈 DEEPCOOL LT360 VISION ARGB (블랙) 제품찾기 이벤트!

      브라보텍 D-2
    • 댓글이 고픈 영자가 올립니다. 댓글로 FLEX~

    • <8월 모바일 출석체크> 통큰 혜택! 8월, 더 커진 혜택

    • [07.16~07.26] 앱코 ULTIMATE GX850 80PLUS골드 풀모듈러 ATX3.0 블랙

    스폰서 PICK

    이전 페이지 1/3 다음 페이지
    • 엔티스 ES 800W 80PLUS스탠다드 ATX3.1

      엔티스 ES 800W 80PLUS스탠다드 ATX3.1

      엔티스
    • 잘만 ALPHA II DS A36(블랙)

      잘만 ALPHA II DS A36(블랙)

      잘만
    • 앱코 G40 시그니처(블랙)

      앱코 G40 시그니처(블랙)

      앱코
    • darkFlash DY470 ARGB 강화유리(화이트)

      darkFlash DY470 ARGB 강화유리(화이트)

      darkFlash
    • AMD 라이젠5-5세대 7600 (라파엘)(멀티팩 정품)

      AMD 라이젠5-5세대 7600 (라파엘)(멀티팩 정품)

      AMD
    • 앱코
    • 엔티스 배너
    • 잘만
    PC버전 로그인 개인정보처리방침 고객센터
    (주) 커넥트웨이브
    대표:
    김정남
    주소
    서울특별시 금천구 벚꽃로 298, 17층(가산동, 대륭포스트타워6차) / 우편번호: 08510
    • 사업자번호:
      117-81-40065
    • 통신판매업:
      제2024-서울금천-0848호
    • 부가통신사업:
      제003081호
    • 고객센터:
      1688-2470 (유료)
    • 이메일:
      cs@cowave.kr
    • 호스팅 제공자:
      (주)커넥트웨이브
    • 사업자 정보확인
    • 이용약관
    • 책임의 한계
    • 청소년 보호정책
    뒤로
    새로고침 맨위로 이동
    안내

    유용하고 재미있는 정보인가요? 공감이 된다면 공감 버튼을,
    그렇지 않다면 비공감 버튼을
    눌러 주세요!
    공감이나 비공감을 선택 하는 경우
    다나와 포인트를 적립해 드립니다.
    ※ 공감 버튼의 총 선택 횟수는
    전체 공개입니다.
    비공감 버튼의 선택 여부는
    선택한 본인만 알 수 있습니다.

    포인트 안내
    목록
    공감 3
    비공감
    댓글
    공유

    공유받은 친구가 활동하면 포인트를!

    URL이 복사되었습니다.

    공유하기

    레이어 닫기

    지금 보는 페이지가 마음에 든다면
    공유하기를 통해 지인에게 소개해 주세요.

    • 카카오톡
    • 라인
    • 페이스북
    • X
    • 밴드
    https://dpg.danawa.com/mobile/news/view?boardSeq=60&listSeq=6043713 복사

    로그인 유저에게는 공유 활동에 따라
    다나와 포인트가 지급됩니다.

    자세히 >

    URL이 복사되었습니다.