Китайская компания DeepSeek, известная своими большими языковыми моделями, планирует развернуть в автономном районе Внутренняя Монголия дата-центр, оснащенный как минимум 160 000 процессорами Huawei Ascend-950DT нового поколения. Как сообщает Bloomberg со ссылкой на источники, этот кластер будет использоваться исключительно для инференса — этапа работы нейросети, когда модель применяется для ответов на запросы пользователей. Для более ресурсоемких задач обучения моделей DeepSeek продолжит использовать оборудование Nvidia.

Если проект будет реализован, он станет крупнейшим известным кластером на чипах Huawei и важным шагом в усилиях Китая по снижению зависимости от американских технологий. Однако аналитики сомневаются, что Huawei сможет выполнить заказ в полном объеме в ближайший год: производственные мощности ограничены, а ключевым узким местом остается дефицит высокоскоростной памяти HBM, необходимой для работы таких процессоров.

Ситуация с памятью может постепенно улучшаться. Крупнейший китайский производитель памяти CXMT впервые начал выпуск микросхем HBM3E — типа памяти, используемой во многих ускорителях ИИ. Однако, по оценкам экспертов, CXMT отстает от южнокорейских Samsung и SK Hynix, а также американской Micron на три-пять лет: эти компании уже наладили массовое производство более совершенной памяти HBM4.

Кластер будет использоваться только для инференса, обучение останется на GPU Nvidia.

Заказ DeepSeek — часть более широкой государственной программы Китая по развитию собственной полупроводниковой индустрии, чтобы не отставать в гонке ИИ. Параллельно китайские компании, включая Alibaba и Baidu, также заказывают чипы Huawei для своих ИИ-проектов, но масштаб DeepSeek выделяется. Ранее DeepSeek использовала кластеры на базе Nvidia H800 для обучения моделей, а теперь стремится диверсифицировать инфраструктуру.

Эксперты отмечают, что ставка на инференс на китайских чипах может быть прагматичным решением: для обслуживания миллионов пользователей нужны большие вычислительные мощности, а требования к точности вычислений при инференсе ниже, чем при обучении. Это позволяет использовать менее производительные, но более доступные чипы. Тем не менее, зависимость от Nvidia в обучении сохраняется, что делает Китай уязвимым к экспортным ограничениям США.

Пока неясно, когда именно DeepSeek получит все заказанные процессоры и начнет эксплуатацию кластера. Представители компаний не комментируют эти планы. Однако сам факт такого заказа демонстрирует стратегическое направление китайской ИИ-индустрии — постепенный переход на отечественное оборудование, несмотря на технологические трудности.