Reddit

First AMD "Gorgon Halo" PC with Max+ PRO 495 launches at $7,399, comes with 192GB of memory

AMD Gorgon Halo 탑재 미니 워크스테이션 출시 — 192GB 메모리에 7,399달러

MINISFORUM이 Ryzen AI Max+ PRO 495 기반 워크스테이션 MS-S1 MAX-P495를 7,399달러에 판매합니다. 192GB 통합 메모리 중 최대 160GB를 Radeon 그래픽에 할당하지만, Reddit에서는 대역폭이 약 300GB/s에 그치는 만큼 가격에 걸맞은 로컬 AI 성능인지 논쟁이 이어집니다.

에디터 노트

파는 건 연산이 아니라 메모리 용량입니다. 대역폭은 전 세대와 같은 300GB/s대인데 용량만 128GB에서 192GB로 늘고 가격은 두 배가 됐습니다. 논쟁도 여기 있습니다. VRAM은 많아도 대역폭이 부족하면 추론이 느려집니다. 용량은 제품이 되고 대역폭은 논쟁이 됐습니다. 그래도 존재 이유가 있습니다. 24GB VRAM엔 안 들어가고 클라우드엔 올리기 꺼려지는 모델들의 틈새입니다. 프라이버시가 돈보다 중요하면 15토큰/초도 감수할 만합니다.

AI 요약

MINISFORUM이 AMD의 차세대 Gorgon Halo 플랫폼을 탑재한 소형 워크스테이션 MS-S1 MAX-P495를 미국에서 판매하기 시작했습니다. Ryzen AI Max+ PRO 495와 192GB 메모리, 2TB SSD 구성의 가격은 7,399달러입니다. 실제 판매를 시작한 Ryzen AI Max+ PRO 495 시스템 가운데 첫 제품으로 소개됐습니다.

메모리 용량은 크지만 가격도 높습니다

Gorgon Halo는 Ryzen AI Max 400 시리즈로 판매되며, Strix Halo의 후속 플랫폼입니다. 주요 변화는 통합 메모리 용량을 최대 192GB까지 지원한다는 점입니다. MINISFORUM 제품은 192GB LPDDR5X-8533 메모리를 256비트 인터페이스로 연결하며, Radeon 그래픽에 최대 160GB를 할당할 수 있습니다.

가격은 HP가 공개한 Ryzen AI Max+ PRO 495 탑재 ZBook Ultra G3a의 7,449달러보다 50달러 낮습니다. 다만 MINISFORUM 구성은 SSD가 2TB이고, HP 기준 구성은 512GB입니다. 기사에서는 두 제품이 같은 192GB 메모리를 갖췄다고 설명합니다.

프로세서는 Zen 5 코어 16개와 RDNA 3.5 Compute Unit 40개를 갖춘 Radeon 8065S 그래픽을 결합합니다. NPU 성능은 최대 55 TOPS이며, MINISFORUM은 프로세서 전체 성능을 최대 131 TOPS로 제시합니다. 시스템에는 120W 성능 모드가 있고, 냉각 장치는 최대 160W 피크 전력을 처리하도록 설계했습니다. 구리 베이스, 히트파이프 6개, 상변화 열전도 재료, 팬 2개를 사용합니다.

확장 슬롯은 PCIe 4.0 x4 전속 슬롯과 M.2 슬롯 2개입니다. 연결 단자는 10GbE 두 개, USB4 V2 80Gbps 두 개, USB4 40Gbps 두 개, HDMI 2.1 FRL을 제공합니다. MINISFORUM은 대량 주문을 안내하고 제품을 AI 모델용 클러스터에 적합하다고 홍보합니다. 일반 소비자용 PC보다는 워크스테이션이나 AI 활용을 염두에 둔 제품입니다.

Reddit 반응

토론의 중심은 메모리 용량과 메모리 대역폭의 균형입니다. 한 이용자는 VRAM 용량이 커도 빠른 추론에 필요한 대역폭이 부족하다고 지적했습니다. 다른 이용자는 Gorgon Halo의 대역폭이 Strix Halo와 비슷한 약 300GB/s라며, 큰 모델과 긴 컨텍스트를 불러오면 처리 속도가 크게 떨어질 수 있다고 답했습니다. 반면 MoE 모델은 이런 시스템에 맞을 수 있고, 특정 하드웨어에 맞춘 추론 엔진이 성능을 끌어올린다는 반론도 나왔습니다.

가격을 두고는 비판이 많았습니다. 한 댓글은 현재 128GB 모델 가격이 3,799달러인 점을 들며, 메모리가 50% 늘어난 제품이 두 배 가까운 가격이라고 비교했습니다. 다른 이용자는 128GB 구성을 갖춘 Framework 데스크톱이 1,999달러에 출시됐다고 언급했습니다. 또 다른 댓글은 시간 단위로 더 강력한 GPU를 빌리는 편이 낫다고 주장했습니다.

용도에 대해서는 로컬 AI 추론과 모델 개발이 주된 목표라는 의견이 많았지만, 적합성에는 이견이 있습니다. 일부는 많은 메모리가 필요한 가상 머신, 데이터베이스, 시뮬레이션, 콘텐츠 제작에도 쓸 수 있다고 봤습니다. 반대편에서는 Radeon의 GPU 연산 성능과 ROCm 지원, 낮은 메모리 대역폭이 로컬 AI와 그래픽 작업의 매력을 떨어뜨린다고 지적했습니다. 로컬 모델을 직접 운영하면 데이터 프라이버시를 지킬 수 있다는 주장과, 느린 로컬 모델보다 클라우드 프런티어 모델을 쓰는 편이 낫다는 반론도 오갔습니다.

  • @u/Uptons_BJs — 이런 제품의 문제는 메모리 대역폭 아닌가요? VRAM은 많아도 빠른 추론을 하기에는 대역폭이 부족합니다.
    • @u/JunkKnight — 대체로 그렇습니다. Gorgon Halo는 Strix Halo와 대략 같은 300GB/s 대역폭입니다. 큰 모델에 긴 컨텍스트까지 넣으면 상당히 느려집니다. MoE 모델이 어느 정도 도움이 되지만, 128~192GB 범위를 겨냥한 모델은 많지 않습니다.
    • @u/Kryohi — 최근에는 매개변수가 300억 개를 넘는 모델이 대부분 MoE입니다. N-gram 같은 최신 기법도 필요한 대역폭을 줄이는 데 도움이 됩니다.
  • @u/Tai9ch — 제대로 된 GPU 시스템보다 훨씬 느리지만, 가격은 두 배이고 전력도 두 배 넘게 씁니다. Strix Halo는 쓸 만한 속도로 추론을 처리하고, 192GB면 Flash 모델 영역까지 다룰 수 있어 클라우드 모델의 대안이 될 수 있습니다. 그래도 7,500달러는 너무 비쌉니다. Strix Halo는 3,000달러일 때 괜찮은 선택이었습니다.
    • @u/Cheerful_Champion — 7,500달러는 터무니없는 가격입니다. Strix Halo는 메모리 용량을 생각하면 비싸도 납득할 만했지만, Gorgon Halo 가격은 좋지 않습니다. Medusa Halo가 나올 때쯤 메모리 가격이 내려가길 바랍니다.
  • @u/A17012022 — 현실적으로 메모리 192GB가 필요한 작업은 무엇인가요? 3D 렌더링인가요? 이 PC의 목표 고객이 누구인지 궁금합니다.
    • @u/dirtyego — 답은 AI와 최첨단 모델의 로컬 실행입니다. 그런 수요만으로 전용 제품을 만들 만큼 시장이 있는지는 모르겠습니다. AI가 개입하면 무엇이든 이해하기 어려워집니다.
    • @u/noobgiraffe — 매달 토큰에 수천 달러를 쓰는 사람들이라면, 대부분의 작업을 처리할 만한 모델을 돌리는 장비를 사서 비용을 회수할 수 있다는 주장도 있습니다. 저희 회사에서도 AI 비용을 줄이는 방안으로 이런 선택지를 논의했습니다.
  • @u/noiserr — 특정 하드웨어에 맞춘 추론 엔진이 나오면서 성능이 크게 좋아졌습니다. 예를 들어 Strix Halo는 Halogen을 사용해 Qwen 3.8 Flash의 프롬프트 처리에서 초당 1,200토큰에 도달할 수 있습니다. 큰 컨텍스트를 자주 처리하는 코딩 에이전트에 의미가 있습니다.

원문: VideoCardz / 번역·요약: Trawling