Huawei: производительность ИИ-систем зависит не только от чипов
Huawei на HUAWEI CONNECT 2026 показала, что производительность ИИ-кластеров определяется не только NPU и FLOPS, но и памятью, интерконнектом, накопителями, ПО и энергопотреблением. В 100 000-NPU кластерах более 40% времени обучения уходит на обмен данными между чипами.
- В традиционных кластерах на 100 000 NPU более 40% времени обучения занимают межчиповые коммуникации
- Ascend 950 даёт 2 ТБ/с интерконнект — в 2,5 раза больше, чем Ascend 910C
- Atlas 950: до 8192 чипов Ascend 950, 8 EFLOPS на FP8 и 16 EFLOPS на FP4
- Atlas 960E: 4096 чипов Ascend 960 дают те же 8 EFLOPS на FP8 при вдвое меньшем числе NPU
Читать дальше
Железо