AMD의 라이젠 AI 맥스와 라이젠 AI 맥스 프로 400 시리즈 프로세서를 탑재한 PC가 판매를 시작했다. AMD는 현지 시각 9월 28일 공식 블로그를 통해 파트너사 제품을 구매할 수 있다고 밝혔다. 이 프로세서는 AI 에이전트를 PC 안에서 직접 실행하는 용도로 설계됐다.
프로세서에는 ‘젠 5’ CPU 코어가 최대 16개, 초당 55조 회 연산이 가능한 NPU, GPU 연산 유닛 40개를 갖췄다. NPU는 AI 연산을 전담하는 반도체다. CPU와 GPU가 메모리를 함께 쓰는 통합 메모리 구조로, 최대 192GB를 탑재하고 이 가운데 최대 160GB를 GPU에 할당할 수 있다. 이전 세대인 300 시리즈는 전체 128GB, GPU용 최대 96GB였다.
AMD는 라이젠 AI 맥스+ 프로 400 시리즈가 매개변수 3,000억 개가 넘는 AI 모델을 4비트 양자화 상태로 실행할 수 있는 세계 최초의 x86 PC용 프로세서라고 설명했다. 양자화는 숫자의 정밀도를 낮춰 모델 용량을 줄이는 기법이다. 여러 모델과 긴 문서, 사내 데이터를 한꺼번에 다루는 에이전트 작업은 메모리를 많이 쓰는데, 확장된 메모리 용량으로 이런 작업을 PC에서 처리할 수 있다는 것이 AMD의 설명이다. 윈도우와 리눅스를 모두 지원하며 파이토치, vLLM, llama.cpp, 올라마, LM 스튜디오 등 개발 도구를 사용할 수 있다.
AMD코리아에 따르면 현재 구매할 수 있는 제품은 HP의 16인치 모바일 워크스테이션 ‘Z북 울트라 G3a’와 프레임워크의 ‘프레임워크 데스크톱’, GMK텍의 ‘EVO-X5 프로’다. HP Z북 울트라 G3a에는 라이젠 AI 맥스+ 프로 495 프로세서와 퍼플렉시티의 로컬 에이전트 ‘포터블 컴퓨터’가 함께 탑재됐다. 이용자는 PC에서 로컬 모델로 작업하다가 필요한 단계에서만 클라우드 모델을 호출할 수 있다. 레노버는 IFA 2026에서 공개한 1.6리터 크기의 초소형 워크스테이션 ‘씽크센터 X 울트라’를 출시할 예정이다. 여러 대를 묶어 쓰는 클러스터 구성을 지원한다.
AMD는 에이전트가 작업 하나를 처리하는 동안에도 추론과 수정, 검색을 반복하며 챗봇보다 훨씬 많은 토큰을 쓴다고 설명했다. 클라우드로 처리하면 호출마다 비용이 발생한다. AMD는 클라우드와 로컬, 혼합 방식의 비용을 비교하는 ‘토크노믹스 계산기’를 함께 제공하고 있으며, 기업이 고성능 클라우드 모델이 필요한 작업만 클라우드로 보내고 나머지는 PC에서 처리하는 방식을 권장했다.
관련 기사: AMD 컴퓨텍스 D-1, 라이젠 AI Max+ 프로 495 공개…”엔비디아 N1X 나와”
자세한 내용은 AMD 공식 블로그에서 확인할 수 있다.
이미지 출처: AMD
AI Matters 뉴스레터 구독하기




추