Reddit

Huawei shelves global AI chip rollout as China's own demand outstrips supply — AMD and Nvidia no longer have to worry.

Huawei, 중국 내수도 못 따라가 글로벌 AI 칩 출시 보류 — AMD와 Nvidia는 당분간 걱정할 필요 없어

Huawei가 차세대 Ascend AI 가속기를 중국에 우선 공급하고 해외 전면 출시 계획을 보류합니다. 중국 내 생산 능력이 수요를 따라가지 못하는 가운데, Nvidia와의 성능 격차는 대규모 클러스터 확장과 전력 소비로 보완한다는 전략입니다.

AI 요약

Huawei가 차세대 Ascend 900 시리즈 AI 가속기를 국제 시장에 전면 공급하지 않고 중국 내수에 우선 배정한다고 밝혔습니다. 중국 내 수요조차 생산 능력을 웃돌기 때문입니다. Huawei의 순환 회장 Eric Xu는 Huawei Connect 행사에서 중국 수요를 먼저 충족할 생산 능력도 부족하다며 국제 시장을 전면적으로 확대할 계획이 없다고 말했습니다. 다만 수요가 특히 강한 일부 국가에는 제한된 물량을 공급하고 있다고 설명했습니다.

Ascend 960부터 980까지의 성능 로드맵

Huawei가 공개한 로드맵에는 Ascend 960DT와 960PR이 2027년에 출시될 예정으로 나옵니다. 두 제품 모두 FP8 학습 성능은 2 PFLOPS이며, FP4 성능은 각각 4 PFLOPS와 8 PFLOPS입니다. 960DT는 288GB 메모리와 9.6TB/s 메모리 대역폭을 사용하고, 960PR은 192GB 메모리와 2.4TB/s 대역폭을 목표로 합니다. 두 제품의 인터커넥트 대역폭은 2.2TB/s입니다.

후속 제품인 Ascend 970은 2028년에 FP4 성능 14 PFLOPS와 288GB 메모리를 목표로 합니다. 2029년 예정인 Ascend 980은 FP8 7.2 PFLOPS, FP4 28 PFLOPS, 384GB 메모리와 38.4TB/s 메모리 대역폭을 제시합니다. Ascend 980 수치는 아직 예비 데이터입니다. 2026년에 출시될 Ascend 950PR과 950DT는 FP8 1 PFLOPS, FP4 2 PFLOPS를 목표로 하며 메모리 구성과 대역폭에서 서로 다른 변형으로 나뉩니다.

칩 단위 성능보다 시스템 규모에 의존

원문 비교표에서 Nvidia H200은 FP8 4 PFLOPS, B300은 FP8 10 PFLOPS와 FP4 15~20 PFLOPS를 제시합니다. 2026년 예정인 Nvidia R200은 FP8 17.5 PFLOPS, FP4 35~50 PFLOPS를 목표로 합니다. Huawei의 Ascend 960DT는 2027년 제품임에도 H200보다 낮은 FP8 수치를 보이고, 960PR의 FP4 성능도 B300보다 낮습니다. 2029년 Ascend 980 역시 R200의 예측 성능을 밑돕니다. 표에는 Nvidia 제품의 희소·밀집 연산과 학습·추론 수치가 함께 표시되어 있어 지표를 맞춰 비교해야 하지만, 원문은 원시 연산 성능에서 Huawei가 Nvidia의 이전 세대와 현 세대 제품을 모두 따라가지 못한다고 평가합니다.

Huawei는 칩 하나의 성능 대신 다수의 가속기를 연결하는 시스템 확장으로 격차를 줄이려 합니다. Atlas SuperPoD는 최대 15,488개의 Ascend 960 NPU를 묶어 FP8 30 EFLOPS, FP4 120 EFLOPS를 낼 수 있다고 제시합니다. 이는 72개 GPU를 연결하는 Nvidia NVL72 클러스터보다 큰 규모입니다. 다만 시스템 규모가 커질수록 전력 소비도 늘어납니다. AMD나 Nvidia 제품을 구할 수 있는 시장에서는 Huawei 클러스터의 성능 대비 전력 효율이 크게 불리해질 수 있어 해외 수요가 제한될 가능성이 있다고 원문은 분석합니다.

공급망 제약과 패키징 전략

Huawei는 근접 패키지 광학(Near-Package Optics, NPO)을 활용해 기존 공정 노드의 생산 여력을 AI 플랫폼 내 다른 부품에 배정하려 합니다. 그러나 중국 파운드리 SMIC가 7nm와 6nm급 공정 생산을 충분히 확대하지 못하고 있어 AI 가속기 자체의 공급량이 제한됩니다. NPO 같은 시스템 통합 기술이 생산 능력 부족을 해결하지는 못하는 상황입니다.

현재 조건에서는 Huawei가 AI 하드웨어를 전 세계에 직접 판매하기보다 클라우드로 제공하는 편이 현실적인 선택으로 제시됩니다. 대학과 연구 기관에 Ascend 하드웨어를 클라우드로 개방하면 Huawei의 소프트웨어 스택인 CANN을 확산시키면서 해외 사용자를 확보할 수 있습니다. 해외 출시를 보류한 이유에는 중국 내 공급 부족뿐 아니라 중국 밖에서 차세대 제품을 구매할 수요가 충분한지 확신하기 어렵다는 판단도 포함됩니다.

Reddit 반응

  • @u/Several-Tax31 — 네, 우울한 소식이네요.
    • @u/livingbyvow2 — 그다지 우울한 일은 아니라고 봅니다. 수요가 그렇게 높다면 처음 예상한 것보다 더 빠르게 생산 능력을 확대할 자본이 충분하다는 뜻일 가능성이 큽니다. 중국은 현지 연구소가 초기 세대 제품을 실제로 시험하고 시행착오 비용과 불편을 부담하게 한 뒤, 경쟁력 있는 가격의 제품으로 해외 시장을 공략하는 전략을 쓰는 것 같습니다. 전기차에서 사용한 방식과 거의 같습니다. 각국이 자국 수요를 보호한다는 이유로 진입 장벽을 세우지 않기를 바라면서 기다려야 합니다.
    • @u/NNN_Throwaway2 — 누구나 예상할 수 있었던 일이라고 봅니다.
    • @u/a_beautiful_rhind — 불과 6시간 전 다른 글에서는 Nvidia가 끝났고 다시 중국을 금지해 달라고 미국 정부에 로비할 거라는 말까지 나왔습니다.
    • @u/BringTea_666 — 그렇지 않습니다. 공급은 어디에 보관하든 공급입니다. 중국 기업이 AMD와 Nvidia 하드웨어 사용을 중단한다는 뜻이므로 Nvidia와 AMD의 고객이 줄고, 두 회사가 요구할 수 있는 가격도 낮아집니다. 그러면 소비자용 AI GPU 가격도 내려갈 수 있습니다. 유럽이 러시아산 석유를 사지 않더라도 러시아 정유 시설이 공격받으면 유럽 가격이 오르는 이유와 같습니다. 인도가 유럽과 그 석유를 두고 경쟁해야 하기 때문입니다.
  • @u/AGM_GM — 서구 경쟁사들이 BYD나 다른 중국 전기차를 걱정할 필요가 없다고 했던 것과 같습니다. 당분간은 그렇게 보이겠지만, 어느 순간 상황이 달라질 것입니다.
  • @u/geldonyetich — 놀랍지는 않습니다. 그래도 중국이 자체 공급을 충족한다면 무역 금지 조치와 상관없이 우리 쪽 공급을 가져가야 할 필요는 줄어듭니다.
  • @u/Miriel_z — 아직은 아니라는 식으로 표현하겠습니다. 적대적인 환경을 가정하면 먼저 자국에 공급해야 하므로 논리적인 선택입니다. 시간을 주면 비교적 빠르게 생산량을 늘릴 수도 있습니다.
  • @u/Armadilla-Brufolosa — 예상했던 일이지만 유럽에도 제품이 들어오기를 바랐습니다. 그러면 이 터무니없는 미국의 추측에서 벗어날 수 있을지도 모릅니다.
  • @u/MotokoAGI — Nvidia와 AMD가 걱정할 일은 아닙니다. 걱정해야 하는 쪽은 소비자입니다.
  • @u/JustTellingUWatHapnd — 여기서 인용한 FP4 FLOPS는 B200과 비슷한 수준입니다. 다만 메모리 대역폭은 훨씬 낮다고 봅니다.
  • @u/Stepfunction — 이것은 여전히 우리에게 이득입니다. 중국이 자체 솔루션을 사용하면 서구의 공급 능력을 가져가지 않게 됩니다. 어떤 공급이든 공급이 늘어나는 일은 좋습니다.
  • @u/Elouakili_Flexy — 글로벌 출시를 보류했다는 표현이 좋은 소식을 가립니다. 해외에 판매할 칩을 남겨둘 수 없을 만큼 중국 내 수요가 높다는 뜻입니다. 감당할 만한 공급 문제입니다.
    • @u/throwawayacc201711 — 상황을 지나치게 좋게 해석한 것 같습니다. 기사는 이 점을 조심스럽게 언급하지만, 중국 밖에서 이 제품을 살 수요가 있는지 불확실하다는 내용도 담고 있습니다. 국내 수요가 높고 공급이 부족하다는 이유만으로 출시 계획을 취소하지는 않습니다. 행간을 읽으면 애초에 구매자가 없었던 것 같습니다.
    • @u/LizardLikesMelons — 저는 중국에 있습니다. 실제 상황은 제품이 완전히 품절된 상태입니다. 저희 조직도 최신 수준의 LLM을 현지에서 운영하려고 하는데 제품을 구하려고 합니다.
    • @u/fallingdowndizzyvr — 행간을 읽기보다 본문을 읽는 편이 좋겠습니다. Huawei는 수년 동안 Ascend 가속기를 판매해 왔고, 생산하는 칩을 전부 팔고 있습니다.
  • @u/__JockY__ — ‘양산 제품이 나오면’이라는 말이 많은 일을 대신하고 있습니다. 실제로는 언제쯤 가능합니까?
    • @u/Poupulino — 아무도 모릅니다. 다만 중국은 이 일을 맨해튼 프로젝트 수준으로 다루면서 막대한 자원과 인력을 투입하고 있습니다.
  • @u/Separate-Client-3213 — ASML은 매우 앞선 기업이고 최고의 연구자들이 일하지만, 중국에도 연구자들이 있습니다. 결국 따라잡지 못할 이유는 없습니다. 문제는 얼마나 오래 걸리느냐입니다. 소비자 입장에서는 경쟁이 많을수록 좋습니다.
    • @u/ProtectionSuper5648 — 현실을 점검할 필요가 있습니다. ASML은 2018년에 첫 EUV 장비를 제품화했습니다. 중국은 이미 해결된 문제를 두고도 8년 뒤처져 있습니다. TSMC는 2019년 무렵 N7+ 공정에 EUV를 적용하기 시작했고 현재는 약 2nm 수준에 있습니다. 중국이 내년에 EUV 장비를 가동하더라도 N7이나 N6 수준에 머물 가능성이 큽니다.

원문: Tom’s Hardware / 번역·요약: Trawling