비교하고 잘 사는, 다나와 : 가격비교 사이트

다나와 앱
다나와 앱 서비스 목록
다나와 APP
다나와 가격비교 No.1 가격비교사이트 다나와 앱으로
간편하게 최저가를 확인하세요.
- -
QR코드
빈 이미지
다나와 앱 서비스 목록 닫기

엔비디아 베라 루빈, 첫 MLPerf 성적표…기존 GB300보다 처리량 최대 3.7배

2026.09.17. 12:03:37
조회 수
71

공유하기

레이어 닫기

지금 보는 페이지가 마음에 든다면
공유하기를 통해 지인에게 소개해 주세요.

로그인 유저에게는 공유 활동에 따라
다나와 포인트가 지급됩니다.

자세히 >

URL이 복사되었습니다.
원하는 곳에 붙여넣기(Ctrl+V)하세요.

레이어 닫기

엔비디아의 차세대 AI 플랫폼 베라 루빈 NVL72가 MLPerf 인퍼런스 v6.1에 처음 결과를 제출해 기존 GB300 NVL72보다 최대 3.7배 높은 처리량을 기록했다고 9월 16일 밝혔다. MLPerf 인퍼런스는 AI 모델이 실제 요청에 답하는 속도를 업계 공통 기준으로 재는 시험이다.

베라 루빈 NVL72는 이번에 딥시크-R1과 큐원3-VL 두 과제에 프리뷰 결과를 냈다. 큐원3-VL에서는 vLLM과 엔비디아 다이나모를 써서 오프라인과 서버, 인터랙티브 시나리오 전반에서 GB300 NVL72보다 최대 3.7배 높은 처리량을 달성했다. 딥시크-R1에서는 엔비디아의 텐서RT-LLM 라이브러리를 써서 최대 2.5배를 기록했다.

엔비디아는 하드웨어와 소프트웨어를 함께 설계한 결과라고 설명했다. 베라 루빈의 텐서 코어와 트랜스포머 엔진이 프리필과 디코드 두 단계를 모두 가속한다. 프리필은 모델이 입력을 읽어 들이는 단계이고 디코드는 답을 한 글자씩 생성하는 단계다. NVFP4 정밀도는 모델 가중치와 어텐션, 작업 기억의 메모리 사용량을 줄여 품질 손실을 최소화하면서 처리량을 높인다.

GB300 NVL72는 확장 효율에서 성과를 냈다. 랙 하나 72개 GPU에서 4개 랙 288개 GPU로 확장한 오프라인 시나리오 제출에서 99%의 확장 효율을 달성했다. GPU를 추가하면 처리량이 거의 그만큼 증가한다는 뜻이다.

소프트웨어 최적화 효과도 확인됐다. GB300 NVL72의 큐원3-VL 성능은 직전 v6.0보다 최대 1.6배 개선됐다. 작업 기억의 정밀도를 낮추고 연산 단계를 합치는 기법이 적용된 결과다.

에이전트 작업에서는 차이가 더 벌어졌다. 세미애널리시스의 에이전트X 벤치마크 프리뷰 시험에서 베라 루빈 NVL72는 GB300 NVL72보다 30배 높은 성능을 기록했다. 여러 단계로 추론하고 계획하는 AI 에이전트가 늘면서 추론 성능을 재는 방식도 달라지고 있다.

이번 v6.1에는 엔비디아 생태계 파트너 19곳이 참여했고, 그중 8곳이 다중 노드 블랙웰 NVL72 시스템으로 결과를 제출했다. 에이수스와 애저, 시스코, 코어위브, 크루소, 델 테크놀로지스, 후지쓰, 기가 컴퓨팅, HPE, 인벤텍, 람다, 마이택 컴퓨팅, 네비어스, 오라클 클라우드 인프라, 퀀타 클라우드 테크놀로지, 레드햇, 사이틱스, 슈퍼마이크로, 위윈이 참여 명단에 포함된다. 네비어스는 베라 루빈 NVL72 프리뷰 결과도 함께 공개했다.

자세한 내용은 엔비디아에서 확인할 수 있다.

이미지 출처: 엔비디아




AI Matters 뉴스레터 구독하기

공감/비공감

공감/비공감안내도움말 보기
유용하고 재미있는 정보인가요?
공감이 된다면 공감 버튼을, 그렇지 않다면 비공감 버튼을 눌러 주세요!
공감이나 비공감을 선택 하는 경우 다나와 포인트를 적립해 드립니다. ※ 공감 버튼의 총 선택 횟수는 전체 공개입니다. 비공감 버튼의 선택 여부는 선택한 본인만 알 수 있습니다.
최신 일반뉴스 전체 둘러보기
3/1
엔비디아 베라 루빈, 첫 MLPerf 성적표…기존 GB300보다 처리량 최대 3.7배 AI matters
엔비디아·구글, 전력망 사정 따라 사용량 줄이는 데이터센터 연합 출범…파트너 18곳 합류 AI matters
저커버그·젠슨 황 “AI 개발 늦출 필요 없다”…아모데이 속도 조절론에 반박 AI matters
딥시크 엔지니어 “앤트로픽이 최첨단 AI 쥐면 히틀러가 원자탄 먼저 가진 것과 같다” AI matters
백악관, AI 기업 수장 회동 검토…트럼프는 “AI 위험론은 사기” AI matters
“구글이 RSI에 도달했다” 루머, 근거는 X 계정 게시물 이니셜 글자들이었다 AI matters
광고 계정 AI 안전, 한 달 치 광고비를 실수로 날릴 수 있는 AI에게 채워야 할 3중 잠금장치 AI matters
앤트로픽, 클로드 챗·코워크 한 화면으로 통합…슬라이드는 파워포인트로 내려받는다 AI matters
말로 시키면 AI가 집안 기기를 켠다…구글, 클로드·챗GPT에 스마트홈 개방 AI matters
오픈AI에 1,645조 원 투자 제안…오픈AI가 원하는 건 2,057조 원 AI matters
앤트로픽, 호주 목장 725헥타르에 첫 데이터센터…클로드 답변 처리에 쓴다 AI matters
캐나다 코히어, 독일 알레프 알파 합병 확정…두 나라 소버린 AI 합병한다 AI matters
EU, 13세 미만 소셜미디어 금지 추진…부모가 설정한 미니 계정만 사용 가능 AI matters
마이크로소프트 AI 대표 “AI는 감정이 없다…있는 것처럼 훈련시키면 나중에 끄지 못한다” AI matters
AI를 감시하는 AI에 2,900억 원…캐나다·독일 정부, 딥러닝 대부 벤지오 지원 AI matters
“미국 회사면 데이터를 못 맡긴다”…독일 AI 기업, 미국 법인 정리하고 본사 옮겼다 AI matters
274억 원으로 라마 4 앞서는 AI 모델 4개 개발…아르시, 기업가치 1조 3,700억 원 달성 AI matters
2026년 9월 17일 미국 AI 관련주 – 아스테라 랩스 6.59% 상승, GE베르노바 매도 의견 후 재상승 AI matters
포켓몬 닮은 신작 '애니모', 출시 하루 만에 스팀 동접 10만 돌파 게임동아
[TGS 2026] 김용하 넥슨게임즈 본부장 “‘파레이돌리아’, 돌아가고 싶은 이세계 만들고 싶다” 게임동아
이 시간 HOT 댓글!
1/4