Huawei ускорила выпуск AI-ускорителей Ascend 960 и раскрыла планы до 2029 года

Huawei представила обновлённую дорожную карту AI-ускорителей Ascend на конференции Huawei Connect. Выпуск Ascend 960DT перенесён на первый квартал 2027 года — на три квартала раньше плана, а FP4-производительность Ascend 960PR выросла вдвое.

Главное
  • Ascend 960DT выйдет в первом квартале 2027 года — на три квартала раньше изначального срока
  • Ascend 960PR получит 8 FP4 PFLOPS для инференса — вдвое больше, чем анонсировалось годом ранее
  • Huawei подтвердила выпуск Ascend 970 в 2028 году и Ascend 980 в 2029 году
Стенд Huawei с дорожной картой AI-ускорителей Ascend на конференции Huawei Connect
Фото: Tom's Hardware

Huawei обновила дорожную карту AI-ускорителей на ежегодной конференции Huawei Connect. Компания ускорила выпуск Ascend 960, раскрыла характеристики Ascend 970 и 980, представила архитектуру Peerium на базе UnifiedBus и расширила портфель интегрированной AI-инфраструктуры.

Сейчас Huawei переходит от архитектуры SIMD, которую использовала в ускорителях Ascend почти десять лет, к новой SIMD+SIMT. Она объединяет векторную обработку и потоковый параллелизм: SIMD отвечает за параллельные операции с данными, SIMT — за задачи с большим числом ветвлений. Это должно повысить утилизацию железа и производительность на разных AI-нагрузках.

Первые NPU на новой архитектуре — Ascend 950PR для prefill и рекомендательных систем и Ascend 950DT для декодирования и обучения. По словам Huawei, платформа Ascend 950 набирает обороты: системы Atlas 950 SuperPoD уже используются в крупном коммерческом развёртывании, хотя деталей компания не привела. Тесты Ascend 950DT дали «хорошие результаты», и в следующем году многие китайские AI-разработчики начнут обучать модели на системах с этими ускорителями.

При этом Huawei признаёт, что производственных мощностей не хватает для покрытия внутреннего спроса. В сентябре 2025 года компания заявляла максимальную конфигурацию Atlas 950 SuperPoD: 2048 CPU Kungpeng 950, 8192 NPU Ascend 950DT, 160 стоек (128 вычислительных и 32 коммуникационные), 8 FP8 EFLOPS, 16 FP4 EFLOPS и 16 ПБ/с совокупной пропускной способности интерконнекта. Однако в июле 2026 года Huawei показала реальную систему Atlas 950 SuperPoD с 256 CPU и 1024 ускорителями — заметно меньше максимума. Архитектура по-прежнему описывается как масштабируемая до 8192 NPU, но на сайте компании эта конфигурация не указана.

Пока внедрение Atlas 950 SuperPoD идёт небыстро — возможно, из-за нехватки поставок или потому, что новая архитектура требует серьёзной переработки софта. В любом случае система станет для Huawei «продувочной» перед более мощными ускорителями серии Ascend 960 и их преемниками.

Семейство Ascend 960 откроет Ascend 960DT — формальный релиз в первом квартале 2027 года, на три квартала раньше прежнего плана. Ожидается 2 FP8 PFLOPS и 4 FP4 PFLOPS, 288 ГБ памяти (предположительно HiZQ) с пропускной способностью 9,6 ТБ/с и интерконнект 2,2 ТБ/с. Ascend 960PR выйдет в третьем квартале 2027 года, на квартал раньше плана: 2 FP8 PFLOPS для обучения и 8 FP4 PFLOPS для инференса — вдвое больше, чем Huawei анонсировала годом ранее. У него 192 ГБ памяти с 2,4 ТБ/с и тот же интерконнект 2,2 ТБ/с.

Для сравнения: GPU Nvidia VR200, ожидаемый в четвёртом квартале 2026 года, обеспечит 35 NVFP4 PFLOPS для обучения и 50 NVFP4 PFLOPS для инференса при 288 ГБ памяти HBM4.

«Мы развиваем серию чипов Ascend с циклом одна генерация в год. В 2028 и 2029 годах мы выпустим Ascend 970 и 980 соответственно. Благодаря закону масштабирования Tau (τ) их вычислительные характеристики продолжат удваиваться, а также ожидаются серьёзные улучшения по пропускной способности памяти, её объёму, пропускной способности интерконнекта и не только», — заявил Дэвид Ван, заместитель председателя совета директоров и ротируемый председатель Huawei, в своём докладе.

Начиная с серии Ascend 960 Huawei планирует сохранять ежегодный цикл выпуска AI-ускорителей. Ускорение Ascend 960DT на несколько кварталов — заметное достижение, но ещё важнее удвоение FP4-производительности Ascend 960PR по сравнению с изначальными ожиданиями. Это, вероятно, означает, что компания существенно переработала низкоточные вычисления процессора, а не просто подкрутила подсистему памяти или частоты. Четырёхкратное превосходство FP4 над FP8 станет отличительной чертой Ascend 970 и 980.

Ascend 970 выйдет в 2028 году с 3,6 FP8 PFLOPS, 14 FP4 PFLOPS, 288 ГБ памяти с 14,4 ТБ/с и интерконнектом 4,4 ТБ/с. Ascend 980 появится в 2029 году с 7,2 FP8 PFLOPS и 28 FP4 PFLOPS, 384 ГБ памяти с 38,4 ТБ/с и интерконнектом 8 ТБ/с. Цифры Ascend 980 Huawei помечает как предварительные.

Для профиТехнические детали: архитектура, цифры, ссылки

Серия Ascend 960 работает на архитектуре SIMD+SIMT и поддерживает форматы FP32, HF32, FP16, BF16, FP8, MXFP8, HiF8, MXFP4 и HiF4. Ключевые параметры:

  • Ascend 960DT (Q1 2027): 2 FP8 PFLOPS, 4 FP4 PFLOPS, 288 ГБ памяти, 9,6 ТБ/с, интерконнект 2,2 ТБ/с.
  • Ascend 960PR (Q3 2027): 2 FP8 PFLOPS для обучения, 8 FP4 PFLOPS для инференса, 192 ГБ памяти, 2,4 ТБ/с, интерконнект 2,2 ТБ/с.
  • Ascend 970 (2028): 3,6 FP8 PFLOPS, 14 FP4 PFLOPS, 288 ГБ, 14,4 ТБ/с, интерконнект 4,4 ТБ/с.
  • Ascend 980 (2029): 7,2 FP8 PFLOPS, 28 FP4 PFLOPS, 384 ГБ, 38,4 ТБ/с, интерконнект 8 ТБ/с (предварительные данные).

Для сравнения: Nvidia VR200 (Q4 2026) — 35 NVFP4 PFLOPS для обучения, 50 NVFP4 PFLOPS для инференса, 288 ГБ HBM4. Huawei также представила архитектуру Peerium на базе UnifiedBus.

Вопросы и ответы

Когда выйдет Ascend 960DT?
Формальный релиз запланирован на первый квартал 2027 года — на три квартала раньше изначального срока.
Какая производительность у Ascend 960PR?
2 FP8 PFLOPS для обучения и 8 FP4 PFLOPS для инференса — вдвое больше, чем анонсировалось годом ранее.
Когда появятся Ascend 970 и 980?
Ascend 970 ожидается в 2028 году, Ascend 980 — в 2029 году. Цифры для 980-й модели предварительные.