Ascend 910C (96 ГБ HBM2e, ~800 TFLOPS FP16) — китайский ускоритель Huawei с ключевым преимуществом: он не подпадает под санкции США и ввозится в РФ прямым каналом из КНР. Публичного замера производительности против H100 с описанной методикой нет — сравнивать приходится на своей модели. Минус — отдельный программный стек CANN/MindSpore вместо CUDA, требующий адаптации кода. H100 зрелее по экосистеме и умеет FP8, но идёт под ограничениями США по параллельному импорту.
Сравнительная таблица
| Параметр | Huawei Ascend 910C | NVIDIA H100 80GB |
|---|---|---|
| Происхождение | КНР | США |
| Санкции США | не подпадает | под ограничениями |
| Канал поставки в РФ | прямой ввоз из КНР | параллельный импорт |
| Память | 96 ГБ HBM2e | 80 ГБ HBM3 |
| Производительность | ~800 TFLOPS FP16 | ~1979 TFLOPS FP8 |
| Замер инференса против H100 | публичного замера с методикой нет | эталон, с которым сравнивают |
| Программный стек | CANN / MindSpore | CUDA |
| Цена, ориентир | $25–35 тыс. | $25–35 тыс. |
| Срок, ориентир | 4–8 нед. | 2–6 нед. |
Ходовой по рынку цифры «60–80% инференса H100» на этой странице нет намеренно. Её нижняя граница восходит к заявлению исследователей DeepSeek, переданному изданиями в феврале 2025 года, — без условий теста, модели и версии стека; верхняя граница не прослеживается ни к одной публикации. Форматы к тому же разные: FP16 у Ascend против FP8 у H100, поэтому пиковые числа несопоставимы напрямую. ТТХ и цены — ориентир по справочнику.
Главный аргумент: санкции и канал поставки
Ключевое различие здесь не в TFLOPS, а в юрисдикции. H100 — американская карта под экспортными ограничениями США: в Россию она едет по параллельному импорту, легально, но с оглядкой на внешние ограничения. Ascend 910C произведён в КНР и под санкции США не подпадает, поэтому ввозится прямым каналом из Китая.
Для госсектора, критической инфраструктуры и компаний под санкционным давлением это решает: долгосрочная предсказуемость поставок и независимость от политики третьих стран часто важнее, чем последние 20–40% пиковой производительности.
Железо: память против скорости
По памяти 910C даже впереди — 96 ГБ HBM2e против 80 ГБ HBM3 у H100, что полезно под крупные модели на инференсе. Но HBM2e медленнее HBM3, а у H100 есть FP8 и Transformer Engine, которых у Ascend нет. Во сколько раз это выливается на конкретной нагрузке — публичного замера с описанной методикой нет.
Это честный размен: 910C берёт объёмом памяти и доступностью, H100 — зрелостью стека и поддержкой FP8. Что перевесит, решает нагрузка, и решается это замером на своей модели: чужого замера с описанной методикой, на который можно сослаться, нет.
Софт: CUDA против CANN/MindSpore
Здесь основная цена перехода. NVIDIA — это экосистема CUDA с максимальной совместимостью фреймворков и готовыми оптимизациями. Huawei Ascend работает на собственном стеке CANN и фреймворке MindSpore: часть моделей переносится, но закладывайте время на адаптацию, профилирование и поиск оптимизированных ядер.
Практический вывод: если у вас уже отлажен пайплайн на CUDA, переход на Ascend — это проект, а не замена карты «в тот же слот». Оценивайте не только цену железа, но и стоимость миграции стека и поддержки.
Кому что подходит
910C — под импортозамещение, госсектор и организации, которым важна независимость от санкций США и предсказуемость поставок, и которые готовы к стеку CANN/MindSpore. H100 — под команды в экосистеме CUDA, которым нужна максимальная зрелость софта и пиковая скорость обучения, а параллельный импорт приемлем.
Часто разумна гибридная стратегия: H100 под обучение и R&D, Ascend под массовый продуктовый инференс, где важнее стоимость и доступность. Конкретную конфигурацию и канал поставки подбираем под задачу и требования по легальности.