비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

엔비디아 베라 루빈, 첫 MLPerf 성적표…기존 GB300보다 처리량 최대 3.7배

2026.09.17. 12:03:37
조회 수
198
2

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

엔비디아의 차세대 AI 플랫폼 베라 루빈 NVL72가 MLPerf 인퍼런스 v6.1에 처음 결과를 제출해 기존 GB300 NVL72보다 최대 3.7배 높은 처리량을 기록했다고 9월 16일 밝혔다. MLPerf 인퍼런스는 AI 모델이 실제 요청에 답하는 속도를 업계 공통 기준으로 재는 시험이다.

베라 루빈 NVL72는 이번에 딥시크-R1과 큐원3-VL 두 과제에 프리뷰 결과를 냈다. 큐원3-VL에서는 vLLM과 엔비디아 다이나모를 써서 오프라인과 서버, 인터랙티브 시나리오 전반에서 GB300 NVL72보다 최대 3.7배 높은 처리량을 달성했다. 딥시크-R1에서는 엔비디아의 텐서RT-LLM 라이브러리를 써서 최대 2.5배를 기록했다.

엔비디아는 하드웨어와 소프트웨어를 함께 설계한 결과라고 설명했다. 베라 루빈의 텐서 코어와 트랜스포머 엔진이 프리필과 디코드 두 단계를 모두 가속한다. 프리필은 모델이 입력을 읽어 들이는 단계이고 디코드는 답을 한 글자씩 생성하는 단계다. NVFP4 정밀도는 모델 가중치와 어텐션, 작업 기억의 메모리 사용량을 줄여 품질 손실을 최소화하면서 처리량을 높인다.

GB300 NVL72는 확장 효율에서 성과를 냈다. 랙 하나 72개 GPU에서 4개 랙 288개 GPU로 확장한 오프라인 시나리오 제출에서 99%의 확장 효율을 달성했다. GPU를 추가하면 처리량이 거의 그만큼 증가한다는 뜻이다.

소프트웨어 최적화 효과도 확인됐다. GB300 NVL72의 큐원3-VL 성능은 직전 v6.0보다 최대 1.6배 개선됐다. 작업 기억의 정밀도를 낮추고 연산 단계를 합치는 기법이 적용된 결과다.

에이전트 작업에서는 차이가 더 벌어졌다. 세미애널리시스의 에이전트X 벤치마크 프리뷰 시험에서 베라 루빈 NVL72는 GB300 NVL72보다 30배 높은 성능을 기록했다. 여러 단계로 추론하고 계획하는 AI 에이전트가 늘면서 추론 성능을 재는 방식도 달라지고 있다.

이번 v6.1에는 엔비디아 생태계 파트너 19곳이 참여했고, 그중 8곳이 다중 노드 블랙웰 NVL72 시스템으로 결과를 제출했다. 에이수스와 애저, 시스코, 코어위브, 크루소, 델 테크놀로지스, 후지쓰, 기가 컴퓨팅, HPE, 인벤텍, 람다, 마이택 컴퓨팅, 네비어스, 오라클 클라우드 인프라, 퀀타 클라우드 테크놀로지, 레드햇, 사이틱스, 슈퍼마이크로, 위윈이 참여 명단에 포함된다. 네비어스는 베라 루빈 NVL72 프리뷰 결과도 함께 공개했다.

자세한 내용은 엔비디아에서 확인할 수 있다.

이미지 출처: 엔비디아




AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 일반뉴스 전체 둘러보기
1/1
웨이모, 텍사스 자율주행차 3주 만에 49% 증가…등록 1,102대 중 3분의 1이 중국산 미니밴 (1) AI matters
세계 공장에서 일하는 산업용 로봇 500만 대…중국이 설치의 59%, 한국은 3만 대로 4위 (1) AI matters
애니보틱스 점검 로봇, 잠긴 방화문도 통과…사원증 대신 디지털 신원 부여 (1) AI matters
엡손, 안전 펜스 없이 쓰는 6축 협동로봇 AX6 출시…코딩 없이 웹 브라우저로 가르친다 (1) AI matters
아카마이, 앤트로픽과 15조 8,000억 원 클라우드 계약…지분 5% 살 수 있는 신주인수권까지 발행 AI matters
블루크로스 “AI 코딩으로 미국 의료비 3조 1,400억 원 추가 지출”…진단은 증가, 치료는 그대로 (1) AI matters
브루킹스 “美 AI 인프라 투자 2032년까지 1경 4,000조 원”…철도 건설기 넘어 역대 최대 (1) AI matters
오라클, 뉴멕시코 2.45GW 데이터센터에 ‘계약 이행 불가’ 통지…2028년 가동 지연에 대비 AI matters
ASML, 상반기 유럽 매출 비중 0%, 한국이 43%로 1위 (1) AI matters
구글 제미나이가 대신 전화 건다…픽셀 11에 ‘콜 포 미’ 도입, 통화 도중 이어받을 수 있어 (1) AI matters
일본 헌책방 매출 5배 증가…AI 학습용으로 50톤이 미국행, 스캔 뒤 폐기 (1) AI matters
구글 딥마인드 수장 “제미나이 4 포스트트레이닝 진입…연내 조기 공개” AI matters
딥시크 연환산 매출 1조 3,000억 원 돌파…API 가격 최대 4.5배 올리고도 수요 유지 AI matters
호주 총리 “오픈AI 에이전트가 메디케어 통계 포털에 무단 접근”…통보는 3개월 뒤에야 AI matters
메타, 카메라 뺀 첫 AI 안경 ‘레이밴 메타 오디오’ 공개…43g에 12시간 재생, 47만 원부터 AI matters
메타 VR 글래스 공개…100g 안경에 5K 화면, 연산과 배터리는 별도 본체로 분리 AI matters
메타 ‘뮤즈 참’ 공개…주머니에 넣는 AI 에이전트, 연말 출시 목표에 가격은 미정 AI matters
레이밴 메타 젠3 공개…배터리 9시간에 마이크 6개, 메타 글래스는 한국에서도 판매 시작 (1) AI matters
미국 AI 관련주 (2026년 9월 25일) 국채금리 5.11%에 지수 보합, AMD 사상 최고가 근접 AI matters
퀄컴, 첫 2나노 모바일 칩 공개…매개변수 300억 개 모델을 휴대폰에서 직접 실행 (1) AI matters
이 시간 HOT 댓글!
1/4