비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

메타, 그래픽카드 한 장으로 돌아가는 300억 매개변수 AI 공개…아파치 2.0으로 무료 배포

2026.08.11. 12:28:02
조회 수
71

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

메타가 현지 시각 8월 10일 매개변수 300억 개 규모의 오픈웨이트 모델 뮤즈 글리머(Muse Glimmer)를 공개했다. 메타 슈퍼인텔리전스 랩스가 개발했고, 가중치는 아파치 2.0 라이선스로 허깅페이스에 공개돼 수정과 재배포, 상업적 활용에 걸리는 제약이 거의 없다.

이 모델은 클라우드에 연결하지 않고 맥이나 PC에 켜 둔 채 쓰는 로컬 에이전트를 상정해 만들어졌다. 함수 호출과 로컬 코딩, 다른 모델의 답을 채점하는 LLM 심사가 주된 용도이며, 전용 인식 인코더를 통해 텍스트와 이미지를 섞어 입력받아 스크린숏과 차트, 문서를 그대로 해석한다. 도구 호출이 실패해도 멈추지 않고 원인을 진단해 다시 시도하도록 학습됐고, 학습 데이터에는 100개가 넘는 언어가 들어갔다. 추론 강도를 여러 단계로 조절해 품질과 속도를 조율할 수도 있다.

메타는 사전 학습과 중간 학습, 사후 학습을 거쳐 뮤즈 글리머를 훈련했다. 사전 학습에서는 상위 모델인 뮤즈 스파크의 출력을 로짓 증류 방식으로 이어받았다. 증류는 큰 모델이 내놓은 답을 교재 삼아 작은 모델을 가르치는 방법이고, 로짓 증류는 최종 답만이 아니라 각 후보 단어에 매긴 점수 분포까지 그대로 따라 하게 만드는 방식이다. 중간 학습에서는 더 긴 문맥과 에이전트 성격이 강한 데이터에 풍부한 추론 기록을 붙여 훈련했다.

마지막 사후 학습에서는 지도 미세조정에 온폴리시 증류와 강화학습을 섞어 사용했다. 지도 미세조정은 정답이 붙은 예시를 보여 주며 다듬는 단계이고, 온폴리시 증류는 학생 모델이 스스로 만들어 낸 답을 놓고 교사 모델이 그 자리에서 교정해 주는 방식이다. 미리 준비한 정답만 외우게 하는 대신 실제로 저지르는 실수를 바로잡는다는 뜻이다. 이 과정에서 일반·추론·코딩·에이전트 영역을 함께 다뤘다.

매개변수 300억 개를 전체 정밀도로 올려 두면 55기가바이트가 넘어 소비자용 그래픽카드에는 들어가지 않는데, 메타는 가중치를 4비트 수준으로 압축해 언어 모델 용량을 20기가바이트 아래로 낮췄다. 가중치를 4비트로 줄이는 양자화는 숫자의 정밀도를 낮춰 용량을 압축하는 기법이다. 남은 공간에는 KV 캐시와 이미지 인식 인코더, 투기적 디코딩용 초안 모델이 함께 들어가 24기가바이트나 32기가바이트 메모리 안에서 동시에 작동한다. KV 캐시는 모델이 앞서 읽은 내용을 다시 계산하지 않으려고 쌓아 두는 작업 기억에 해당한다. 메타는 이 압축이 에이전트 작업 정확도를 거의 떨어뜨리지 않는다고 밝혔다.

응답 속도에는 DFlash 기반의 가벼운 초안 모델이 쓰인다. 언어 모델은 보통 단어 조각인 토큰을 하나씩 차례로 만들어 내는데, 투기적 디코딩은 작은 초안 모델이 토큰 여러 개를 미리 제안하면 본 모델이 한꺼번에 검증해 맞는 것은 받아들이고 틀린 것만 고치는 방법이다. 메타는 여기에 DFlash라는 초안 모델을 붙였고, 메타 측정에서 RTX 5090은 3.1배, M5 맥스는 1.8배, M4 맥스는 1.5배 빨라졌다. 메타는 이 방식이 출력 품질을 그대로 유지한다고 설명했다.

메타는 젬마4-31B, 큐원3.6-27B와 성능을 비교했다. 딥서치 QA와 MCP-아틀라스, 타우-벤치, SWE-벤치 같은 전 과정 벤치마크에서 같은 크기대 모델 중 강한 성적을 냈다고 밝혔다. 다만 공개된 비교표는 메타가 자체 평가한 결과다. 모델은 공개 전 메타의 고급 AI 스케일링 프레임워크 기준으로 오픈웨이트 배포 적격 여부를 검토받았다.

llama.cpp와 MLX, ExecuTorch 통합이 며칠 안에 추가되고, 올라마와 LM 스튜디오, 언슬로스로 로컬 실행이 가능하다. 서버 쪽은 vLLM과 SGLang을, 외부 서비스는 투게더 AI와 파이어웍스 AI, 오픈라우터를 쓸 수 있다. 파이토치의 토치타이탄으로 추가 학습도 할 수 있다. 메타는 AMD와 Arm, 델, 인텔, 엔비디아와 기기별 최적화를 진행 중이라고 밝혔다.

자세한 내용은 메타 AI 리서치에서 확인할 수 있다.

이미지 출처: 메타




AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 일반뉴스 전체 둘러보기
3/1
일러스트레이터 Tokkyu 님이 소중하게 생각하는 반짝이는 질감 표현과 ‘나만의 스타일’을 갈고닦는 법 게임동아
“게임 잘하면 관제사 해볼래?”…美 FAA 게이머 겨냥 채용, 2,000명 이상 충원 게임동아
요즘 인디 게임들 핫하네…협동 파티 게임 ‘빅 워크’, 출시 6일 만에 100만 장 돌파 게임동아
엠게임 자체 개발한 방치형RPG ‘귀혼키우기’ 사전예약 시작 게임동아
라이엇 게임즈, '와일드 팬페스트 in 현대백화점 판교점' 예약 일정 공개 게임동아
2026년 8월 11일 미국 AI 관련주 — 팔란티어 주간 39% 상승, AI 반도체 3인방은 재하락 AI matters
앤트로픽 클로드, 160년 묵은 리만 가설 제타 하한 41.6%에서 67.2%로 높였다 AI matters
메타, 그래픽카드 한 장으로 돌아가는 300억 매개변수 AI 공개…아파치 2.0으로 무료 배포 AI matters
앤트로픽, 데이터센터 전용 회사 세운다…”주민 전기요금 인상분은 우리가 낸다” AI matters
메모리값에 눌린 애플…20주년 ‘올글라스 아이폰’ 취소됐다는 분석에 제프리스 ‘팔아라’ AI matters
인텔, 21조 원어치 주식 찍어낸다…”AI 수요가 감당이 안 된다” AI matters
오픈AI, GPT-5.2·5.3 채팅 모델 API에서 제거…코드 안 바꿨으면 오늘부터 먹통 AI matters
호주 남부, AI 왕립조사위원회 설치…교육·공공서비스에 미친 영향 내년 7월까지 조사 AI matters
AI·방산 스타트업 전문 은행 에레보르, 2조 원 유치 추진…기업가치 11조 원 AI matters
아트뮤, 40/80G 초고속 전송 지원하는 ‘가변 액티브 쿨링’ SSD 인클로저 공개 다나와
서린씨앤아이 '아틱 리퀴드 프리저 III 프로' 시리즈 구매 고객 대상 'P12 프로 PST' 증정 다나와
주간뉴스 8/9 - 램/그래픽/메인보드 인상, 노바레이크 지연, 솔리다임 미국상장? 플래시 메모리 서밋, 애플-CXMT, 챗GPT-5.6 루나, AI 사건사고 기글하드웨어
시그마체인, 싸이월드 인수 완료 발표 ‘10월 베타 서비스’ IT동아
창립 50주년 에이서, "게임의 판을 바꾸다"…김포서 '에이서 데이' 팝업스토어 열어 베타뉴스
ESSENCORE KLEVV CRAS C910G M.2 NVMe 500GB 파인인포 [써보니] 위클리포스트
이 시간 HOT 댓글!
1/4