Средняя стоимость развертывания ведущих больших языковых моделей в России выросла с 13,7 млн руб. в 2025 году до 38,8 млн руб. в 2026-м, подсчитали аналитики MWS Cloud (входит в «МТС Web Services»). Рост составил 2,8 раза. В расчеты включены серверы с графическими процессорами и коммутаторы, необходимые для запуска модели и обработки одного запроса максимального размера.
Аналитики MWS Cloud изучили требования к инфраструктуре для популярных открытых LLM, вышедших весной и летом соответствующих лет. В выборку 2025 года вошли Kimi K2, gpt-oss-120b, Gemma 3 27B, GLM-4.5V, Qwen3 235B и российская Cotype Pro 2. Для 2026 года рассматривались Kimi K3, Qwen3.5 397B, DeepSeek-V4-Pro, DeepSeek-V4-Flash, GLM-5.2, Gemma 4 и Cotype Pro 3. Новые поколения моделей стали заметно мощнее: они лучше справляются со сложными задачами и учитывают больше информации в одном запросе, но требуют больше видеопамяти и более производительных ускорителей. Одновременно растет рыночная стоимость самих GPU, что делает развертывание ИИ на собственной инфраструктуре все более затратным.
| Год | Модели | Средняя стоимость, млн руб. |
|---|---|---|
| 2025 | Kimi K2, gpt-oss-120b, Gemma 3 27B, GLM-4.5V, Qwen3 235B, Cotype Pro 2 | 13,7 |
| 2026 | Kimi K3, Qwen3.5 397B, DeepSeek-V4-Pro, DeepSeek-V4-Flash, GLM-5.2, Gemma 4, Cotype Pro 3 | 38,8 |
Отдельно MWS Cloud оценила возможность использования китайских ускорителей Huawei Ascend 910B. Подтвержденная поддержка есть не для всех моделей: в выборке 2025 года — для трех из шести, в 2026-м — для пяти из семи. Для моделей с поддержкой Huawei в 2025 году в среднем требовалось 10,7 ускорителя Ascend 910B, в 2026-м — 13,6. Официальной цены на эти GPU нет, но, по оценкам, она составляет от половины до двух третей стоимости сопоставимых решений Nvidia.
Аналитики MWS Cloud связывают рост с потребностью в более мощных GPU и памяти.
Генеральный директор MWS Павел Воронин отметил, что цены на GPU в России зависят от мирового рынка: глобальная гонка в ИИ увеличивает спрос и поддерживает рост стоимости ускорителей. По данным исследования MWS Cloud, 47% респондентов ожидают удорожания GPU-ресурсов до осени 2027 года, а 45% считают, что их значение для бизнеса будет расти. Воронин добавил, что если покупка оборудования перестает окупаться, компании выбирают более компактные модели, оптимизируют вычисления или переходят в облако, где платят только за фактически используемые мощности.
Индикатором сдвига в сторону облака стал рост потребления китайских LLM: в первом полугодии 2026 года оно более чем в 11 раз превысило показатель за весь 2025 год на платформах MWS GPT Model Hub и MWS GPT. Отечественный ИИ-рынок при этом растет в два раза быстрее рынка ИТ в целом, заявил премьер-министр Михаил Мишустин в мае 2026 года. Затраты на федеральный проект «ИИ» в 2025 году составили 9,03 млрд руб. — на 19% больше, чем в 2024-м, по данным Минцифры. Более половины российских компаний внедряют ИИ в бизнес-процессы, инвестировав в 2025 году 257 млрд руб., сообщил вице-премьер на конференции Data Fusion.


