DeepSeek вместе с Huawei разрабатывают альтернативу CUDA Компании выложили в опенсорс набор инструментов для чипов Huawei Ascend. Сейчас это главные китайские AI-ускорители, на которые переходят все их стартапы. Большая проблема с переходом на новое железо заключается в софте: вся индустрия 10+ лет писала все под CUDA от Nvidia, и теперь Китаю предстоит восстановить то же самое для своих чипов. Собственно, этим DeepSeek и занимается. В частности, они выпустили в опенсорс Ascend-версии своих фирменных библиотек, на которых держатся ее собственные модели: DeepGEMM (умножение матриц), DeepEP (связь между чипами для MoE-моделей), FlashMLA (attention) и еще несколько. API у них такая же, как у Nvidia-версий, поэтому код с Nvidia переезжает почти без переписывания. Весь этот стек работает на TileLang: это тоже китайский проект. DeepSeek утверждает, что язык компактнее CUDA, а все TileLang-ядра, на которых она обучает свои модели, уже работают на Ascend. Понятно, что это замена не всего стека CUDA, а только написания ядер, но направление понятное: Китай методично закрывает зависимость от Nvidia на всех уровнях.