DeepSeek и Huawei выложили в открытый доступ набор инструментов для ИИ-ускорителей Huawei Ascend. Об этом сообщает Telegram-канал @data_secrets. По его данным, компании вместе разрабатывают альтернативу CUDA, программной платформе Nvidia.[1][2]
DeepSeek выпустила версии своих фирменных библиотек для Ascend. Это DeepGEMM для умножения матриц, DeepEP для связи между чипами в MoE-моделях, FlashMLA для механизма внимания и ещё несколько. На этих библиотеках держатся собственные модели компании. Канал пишет, что API у новых версий такой же, как у версий для Nvidia, поэтому код переезжает почти без переписывания.[3][4]
Весь стек работает на TileLang, тоже китайском языке программирования. DeepSeek утверждает, что он компактнее CUDA и что все TileLang-ядра, на которых компания обучает свои модели, уже работают на Ascend.[5][6][7]
Канал называет Ascend главными китайскими ИИ-ускорителями: на них переходят китайские стартапы. Главная трудность при переходе связана с софтом. «Вся индустрия 10+ лет писала все под CUDA от Nvidia, и теперь Китаю предстоит восстановить то же самое для своих чипов», — пишет @data_secrets.[8][9]
Канал оговаривает, что новые инструменты заменяют не весь стек CUDA, а только написание ядер.[10]
По материалам
Текст составлен ИИ по материалам ниже и не содержит фактов, которых нет в источниках.
они выпустили в опенсорс Ascend-версии своих фирменных библиотек, на которых держатся ее собственные модели: DeepGEMM (умножение матриц), DeepEP (связь между чипами для MoE-моделей), FlashMLA (attention) и еще несколько.
Большая проблема с переходом на новое железо заключается в софте: вся индустрия 10+ лет писала все под CUDA от Nvidia, и теперь Китаю предстоит восстановить то же самое для своих чипов.
Понятно, что это замена не всего стека CUDA, а только написания ядер, но направление понятное: Китай методично закрывает зависимость от Nvidia на всех уровнях.