비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

엔비디아, 소형 오픈모델 ‘네모트론 3.5 라이트닝’ 공개…초당 670토큰 처리

2026.08.13. 10:22:26
조회 수
22

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

엔비디아(NVIDIA)가 소형 오픈가중치 모델 ‘네모트론 3.5 라이트닝(Nemotron 3.5 Lightning)’을 공개했다. 현지 시각 8월 11일 엔비디아 기술 블로그에 게재된 내용이다. 전체 30B 파라미터 가운데 요청마다 3B만 활성화되는 혼합 전문가(MoE) 구조로, 항상 켜진 AI 에이전트의 실행 계층을 겨냥했다. 가중치와 데이터, 학습 레시피까지 모두 공개됐다.

엔비디아는 이 발표를 두고 대형 모델과 비견될만한 수준의 성능이라고 밝혔다. 지능 벤치마크에서 오픈AI의 gpt-oss-120b와 비슷한 결과를 내면서도 처리 속도는 이 등급에서 가장 빨라 초당 약 670토큰을 기록했다. 에이전트 벤치마크에서는 더 큰 네모트론 3 슈퍼까지 앞서는 성과를 보였다. 지난해 엔비디아 연구진이 100억 파라미터 미만 모델이 대부분의 에이전트 작업을 10분의 1에서 30분의 1 비용으로 처리할 수 있다고 주장한 논문의 상용화 증명에 가깝다.

구조는 맘바-트랜스포머 하이브리드에 멀티토큰 예측(MTP)을 얹은 형태다. 텍스트 전용 추론 모델로 컨텍스트 창은 100만 토큰을 지원한다. BF16과 NVFP4 두 가지 가중치가 제공되며, NVFP4 버전은 4비트 양자화로 단일 DGX 스파크나 H100 GPU에서 구동할 수 있다. 추측 디코딩용 드래프트 모델 D스파크·D플래시도 함께 배포됐다. 다중 GPU를 요구하는 대형 모델과 달리 소형 하드웨어에서도 에이전트를 돌릴 수 있다.

에이전트 하네스와의 결합도 염두에 뒀다. 오픈클로(OpenClaw)와 허메스 에이전트 같은 오픈소스 하네스에서 바로 쓰도록 설계됐고, 엔비디아가 운영하는 오픈소스 보안·관리 스택 네모클로(NemoClaw)도 지원한다. 배포는 빌드닷엔비디아닷컴과 오픈라우터에서 바로 시도할 수 있고, 딥인프라와 파이어웍스, 코어위브, 네비우스, 크루소 등이 서버리스 추론을 제공한다.

네모트론 3.5 라이트닝은 네모트론 3 나노 30B A3B의 후속으로, 네모트론 3.5 계열의 첫 모델이다. 라이선스는 상업적 이용이 가능한 오픈MDW-1.1이다. 엔비디아는 이번 출시가 소형 모델의 효율과 에이전트 실행 성능을 함께 끌어올린 사례라며, 이후 라인업 확대 가능성도 언급했다. 하드웨어를 파는 회사가 오픈가중치 소형 모델을 직접 내놓는 이유도, 에이전트가 늘수록 추론용 GPU 수요가 함께 커진다는 판단에서다.

자세한 내용은 엔비디아에서 확인할 수 있다.

이미지 출처: 엔비디아




AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 일반뉴스 전체 둘러보기
2/1
“AI가 줄이는 탄소보다 늘리는 탄소가 많다” AI matters
출시 전에 100만 명이 먼저 써본다…83억 페르소나로 만든 시뮬레이션 환경 AI matters
앤트그룹, 촉각 로봇 스타트업 다이몬 로보틱스에 수백억 원 투자…두 달 만에 또 유치 AI matters
중국 첫 상장 휴머노이드 로봇 기업 유니트리, 상하이 개인 청약 8,000배 초과…공모가 기준 몸값 13조 원 AI matters
오픈AI, 챗GPT 데스크톱 앱 리눅스 프리뷰 공개…코덱스·워크 통합 AI matters
엣지 AI 칩 액세라, 상반기 매출 182% 급증…스마트드라이빙·로봇용 반도체 세 사업 동반 성장 AI matters
포니에이아이, 자율주행 누적 1억 km 돌파…4세대 무인 대형트럭 양산도 시작 AI matters
MS, 이미지 모델 MAI-Image-2.6 공개…아레나 순위 2위로 점프 AI matters
MS, 코딩 모델 MAI-Code-1.1-Flash 공개…비용 4분의 1로 줄이고 코파일럿에 반영 AI matters
xAI, 상시 작동 에이전트 ‘그록 봇’ 베타 공개…월 28만 원부터 AI matters
FTC, AI 편향 규제 컴플라이언스 서한 발송…기준 문서는 앤트로픽만 거론 AI matters
구글, 의료 AI ‘AMIE’ 영상 상담 첫 시연…표정·기침까지 읽어낸다 AI matters
챗GPT, 북미서 레스토랑 예약 지원 시작…오픈테이블·레시·옐프 연동 AI matters
엔비디아, 소형 오픈모델 ‘네모트론 3.5 라이트닝’ 공개…초당 670토큰 처리 AI matters
미스트랄, 유럽·미국 선택형 추론 모델 공개…2030년 1GW 컴퓨팅 목표 AI matters
‘암호화’ 추론의 허점…오픈AI·앤트로픽·구글 API에서 숨은 사고 과정 추출 AI matters
AI 에이전트 보안 옵시디언, 시리즈 D 8,500만 달러…기업가치 11억 달러 AI matters
호주 AI 인프라 퍼머스, 20억 달러 조달…기업가치 105억 달러로 AI matters
마누스, 8월 25일까지 무료로 쓴다…메타 인수 무산이 부른 데이터 이전 때문 AI matters
리안리 ‘하이드로시프트 II OLED’ 1차 완판…서린씨앤아이, 2차 물량 공급 뉴스탭
이 시간 HOT 댓글!
1/4