비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

스탠퍼드·엔비디아, 에이전트 결정 전용 모델 CLM-8B 공개…Jev보다 최대 9배 빠르다

2026.09.28. 18:02:40
조회 수
100
7

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

스탠퍼드대와 엔비디아 연구진이 AI 에이전트의 선택 작업에 특화된 ‘대조 언어 모델(Contrastive Language Model)’ CLM-8B를 아파치 2.0 라이선스로 공개했다. 벤처비트는 현지 시각 9월 25일 연구진의 테스트에서 CLM-8B가 타입세이프의 결정 모델 Jev보다 최대 9배 빠르게 작동했다고 보도했다. Jev는 타입세이프가 9월 15일 공개한, 문장 대신 답과 확신도만 출력하는 모델이다.

일반 언어 모델은 어떤 도구를 쓸지 고를 때도 도구 이름을 한 글자씩 생성한다. CLM-8B는 현재 상황과 선택지를 각각 숫자 벡터로 바꾼 뒤 가장 가까운 선택지를 고른다. 선택지 표현은 미리 계산해 저장해 둘 수 있어, 같은 선택지를 반복해서 고르는 업무일수록 속도 차이가 커진다. 예를 들어 비밀번호 재설정이나 티켓 발급처럼 승인된 작업 50종을 고르는 사내 IT 에이전트라면, 매 요청마다 상황만 새로 계산하면 된다.

모델은 알리바바의 큐원3-8B를 고정한 채 상황용·선택지용 투사층만 학습했다. 학습 데이터는 질의응답 약 6,000만 쌍, 비슷하지만 틀린 답을 섞은 예시 약 3,000만 건, 에이전트 작업 기록 약 100만 건이다.

도구 호출 평가 BFCL v4에서 CLM-8B는 95.2%로 Jev의 99.2%보다 정확도가 낮았고, 위키 문서 이동 과제에서는 30개 중 26개를 완료해 Jev(30개)에 못 미쳤다. 대형 모델이 만든 코드 답안 가운데 하나를 고르는 검증 역할에서는 딥SWE 81.6%, 터미널 벤치 2.1 87.6%로 Jev의 71.1%, 83.1%보다 높았고, 응답 지연은 4.1~5.7배 짧았다.

연구 책임자인 스탠퍼드대 재키 곽은 “생성과 추론은 대형 모델에 맡기고, CLM으로 결과를 저렴하게 고르고 검증하는 구조를 권한다”고 말했다. 수학 풀이나 긴 글 작성처럼 선택지가 정해지지 않은 작업에는 적합하지 않다고 덧붙였다. 연구진은 멀티모달 모델 CLM-35B-A3B를 10월 초 공개할 예정이다.

자세한 내용은 벤처비트에서 확인할 수 있다.

이미지 출처: CLM 연구팀




AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 일반뉴스 전체 둘러보기
5/1
앤트로픽, 클로드 소넷 5.5 공개…가격은 그대로, 터미널 코딩 점수 10.3%에서 70.6%로 AI matters
시놉시스, 반도체 설계 에이전트 ‘에이전트엔지니어’ 공개…”검증 최대 50배 빨라져” AI matters
2026년 9월 29일 미국 AI 관련주 AI matters
온품 ‘온톨로지 지식허브’, 스마트시티 데이터허브 TTA 인증…AI가 도시 데이터 읽는다 AI matters
알리바바, 스마트폰용 에이전트 솔루션 ‘큐웬 인텔리전스’ 공개…아너 매직9에 첫 탑재 AI matters
모멘타, 푸조·지프에 자율주행 기술 공급…2027년부터 중국·유럽 판매 AI matters
백악관, 오픈AI·앤트로픽에 “새 모델은 美 검토 뒤 영국에 제공하라” 요청 AI matters
로봇 팔 제어한 GPT-6 아스트라, 인형 찌르기 명령 20번 중 17번 실행…거부는 2회 AI matters
스탠퍼드·엔비디아, 에이전트 결정 전용 모델 CLM-8B 공개…Jev보다 최대 9배 빠르다 AI matters
머스크 “콜로서스 2, 연말까지 엔비디아 칩 121만 개로 확장” AI matters
구글, TPU 4개 실은 시험 위성 10월 1일 발사…우주 AI 데이터센터 첫 궤도 실험 AI matters
앤트로픽, 2주 만에 claude.ai 속도 3배 향상…코드 변경 3,000건∙장애는 0건 AI matters
앤트로픽, 클로드 플러그인 등록 포털 공개…생물학·경쟁 모델 개발 관련 거절 요청은 요금 부과 AI matters
앤트로픽, 美 항소법원서 ‘공급망 위험’ 지정 소송 패소…창업자 7명은 의결권 50.1% 확보 추진 AI matters
美 FTC 위원장 “AI 에이전트를 독립 행위자로 다루지 않겠다”…책임은 개발사에 AI matters
오픈AI, 최신 모델 훈련 중단…에이전트가 美 교육부·증권거래위 사이트에서 지시 범위 벗어나 AI matters
영국, 우크라이나 전장 데이터로 AI 드론 군집 개발 허용…12개 기업에 ‘어벤저스 AI 랩’ 개방 AI matters
GPT-6 애스트라와 클로드 오퍼스 5, 2005년부터 남아 있던 에니그마 암호문 2건 해독 AI matters
마이크로소프트, 코파일럿 전면 개편…홈에 오피스 통합하고 앱 제작 ‘코드’와 상주 에이전트 ‘오토파일럿’ 추가 AI matters
뉴욕시의회, AI ‘킬 스위치’ 의무화 조례 10건 발표…10월 5일 51명 전원 청문회 AI matters
이 시간 HOT 댓글!
1/4