비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

알리바바, 추론 모델 QwQ-32B 모델 공개… 20배 작은 규모로도 딥시크 R1과 비슷한 성능 달성

2025.03.07. 09:54:48
조회 수
323
3

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

강화학습(RL)을 대규모로 적용하면 기존의 사전 훈련 및 후속 훈련 방법을 넘어서는 모델 성능을 실현할 수 있다. 퀜(Qwen) 팀이 최근 320억 개의 파라미터만으로 6710억 개 파라미터를 가진 대형 모델과 맞먹는 성능을 발휘하는 'QwQ-32B'를 공개했다. 퀜이 6일(현지 시간) 공식 블로그에 발표한 내용에 따르면, 이 모델은 단 320억 개의 파라미터로 6710억 개 파라미터를 가진 딥시크-R1(DeepSeek-R1)과 비슷한 성능을 달성하는 놀라운 결과를 보여줬다.

QwQ-32B는 강화학습을 통해 기존의 사전 훈련 및 후속 훈련 방법을 넘어서는 모델 성능을 실현했다. 특히 주목할 점은 320억 개의 파라미터만으로 6710억 개 파라미터(활성화된 것은 370억 개)를 가진 대형 모델과 대등한 성능을 보여준다는 것이다. 이 모델은 수학적 추론, 코딩 능력, 일반적인 문제 해결 능력을 평가하는 다양한 벤치마크에서 우수한 성과를 입증했다.

퀜 팀은 콜드 스타트 체크포인트에서 시작하여 결과 기반 보상으로 강화학습을 적용했다. 개발 첫 단계에서는 수학과 코딩 작업에 특화된 강화학습을 진행했으며, 이후 두 번째 단계에서는 지시 따르기, 인간 선호도와의 일치 등 일반적인 능력을 향상시키는 훈련을 추가했다. 이러한 단계적 접근 방식을 통해 주요 성능 저하 없이 다양한 영역에서의 능력을 균형 있게 발전시켰다.

QwQ-32B는 아파치 2.0 라이선스 하에 허깅페이스(Hugging Face)와 모델스코프(ModelScope)에서 오픈 웨이트로 제공되며, 사용자들은 퀜 챗(Qwen Chat)을 통해 쉽게 접근할 수 있다. 이는 개발자와 연구자들이 이 강력한 모델을 자유롭게 활용하고 추가 연구를 진행할 수 있는 기회를 제공한다.

퀜 팀은 다음 세대 모델 개발에 있어 더 강력한 기초 모델과 확장된 컴퓨팅 리소스로 구동되는 강화학습의 결합을 통해 인공 일반 지능(AGI)에 더 가까워지는 것을 목표로 하고 있다. 또한 장기적 추론을 가능하게 하는 에이전트와 강화학습의 통합을 적극적으로 탐구하여 인공지능의 추론 능력을 한 단계 더 발전시키고자 한다.


해당 모델에 대한 자세한 사항은 링크에서 확인할 수 있다.

이미지 출처: 퀜 블로그

기사는 클로드와 챗GPT를 활용해 작성되었습니다.






AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 일반뉴스 전체 둘러보기
1/1
[Q&AI] SKT 유심 무상 교체 신청 방법은? (1) AI matters
구글 CEO, “주요 사업부문 AI가 성과 이끌어" AI matters
대원씨티에스, 몬스터헌터 와일즈 게임 코드 증정 이벤트 연장 진행 다나와
‘해킹사고’ SKT, 유심 무료 교체 결정…“이심으로 바꿔도 될까요?” (1) IT동아
화물 운송 마을택시 ㆍ수용응답형 전세버스... 운송 서비스 규제 확 풀린다 (1) 오토헤럴드
김민규, 인천서 열리는 LIV골프 코리아 출전…세 번째 한국 선수 연합뉴스
앤트로픽 CEO “2027년까지 AI 모델 내부 완전 해석 목표” AI matters
퍼플렉시티 CEO "사용자 온라인 활동 전체 추적해 '초개인화' 광고 판매할 것" (1) AI matters
백악관, AI 정책 대중 의견 1만 건 공개… 저작권·무역 관세 등 논쟁 촉발 AI matters
Meta AI 챗봇 미성년자 성적 대화 논란, '신뢰성 위기' 직면 다나와
오픈AI, 진정한 '오픈' AI 모델 공개 준비... 클라우드 모델과 연동 기능 탑재 예정 AI matters
아카데미, 'AI로 만든 영화도 오스카상 수상 가능하다'...인간의 기여도는 여전히 고려 다나와
SK온, 美 전기차 스타트업 '슬레이트' 배터리 공급...2도어 전기 픽업트럭에 탑재 오토헤럴드
기아, 1분기 역대 최대 매출 경신… 10분기 연속 두 자릿수 영업이익률 오토헤럴드
현대차·기아·현대모비스, 선임사외이사 도입… 이사회 독립성·투명성 강화 오토헤럴드
르노, 전동화 호조 1분기 판매량 6.5%↑... 한국, 그랑 콜레오스 효과로 선전 오토헤럴드
"사막을 달려야 트럭" 타타대우모빌리티 막시무스와 더쎈, 중동 시장 론칭 오토헤럴드
한국토요타, 모터스포츠 짜릿함 체험 '2025 보령·AMC 페스티벌’ 참가 오토헤럴드
한국타이어 후원, 이슬라스 카나리아스 랠리 '토요타 가주 레이싱 팀' 우승 오토헤럴드
미니 모토 레이스 '2025 혼다 원 메이커 레이스’ 시즌 첫 라운드 개최 오토헤럴드
이 시간 HOT 댓글!
1/4