MWS Cloud проанализировала требования к вычислительной инфраструктуре для запуска ведущих мировых и российских больших языковых моделей. Согласно оценкам, средняя стоимость минимального набора ускорителей Nvidia для запуска одной модели выросла с 13,7 млн руб. в 2025 году до 38,8 млн руб. в 2026 году – в 2,8 раз.
/13269846/original.jpg)
Источник: rawpixel.com (CC0)
MWS Cloud проанализировала требования к вычислительной инфраструктуре для запуска ведущих мировых и российских больших языковых моделей. Согласно оценкам, средняя стоимость минимального набора ускорителей Nvidia для запуска одной модели выросла с 13,7 млн руб. в 2025 году до 38,8 млн руб. в 2026 году – в 2,8 раз.
В анализ, проведенный MWS Cloud, вошли популярные открытые модели, выпущенные весной и летом 2025 и 2026 года. Для 2025 года рассматривались Kimi K2, gpt-oss-120b, Gemma 3 27B, GLM-4.5V, Qwen3 235B и российская Cotype Pro 2. Для 2026 года – Kimi K3, Qwen3.5 397B, DeepSeek-V4-Pro, DeepSeek-V4-Flash, GLM-5.2, Gemma 4 и Cotype Pro 3.
Расчет сделан для минимального количества видеокарт, необходимого для запуска модели и обработки одного запроса максимального заявленного размера. В стоимость включены серверы с GPU и коммутаторы к ним.
Новые LLM становятся более мощными: они лучше справляются со сложными задачами и могут учитывать больше информации в одном запросе. Однако для этого им требуется больше памяти и более производительные GPU. При этом растет и стоимость самих видеокарт, поэтому развертывание моделей обходится дороже.
Отдельно MWS Cloud оценила возможные конфигурации на китайских ускорителях Huawei Ascend 910B. Возможность запуска на них подтверждена не для всех рассмотренных LLM: в выборке 2025 года подтверждение есть для трех из шести моделей, в 2026 году — для пяти из семи.
Среди моделей с подтвержденной или экспериментально подтвержденной поддержкой Huawei в 2025 году в среднем требовалось 10,7 ускорителя Ascend 910B, а в 2026 году — 13,6. Официальной цены на данные GPU нет, но, по оценкам, она может составлять от половины до двух третей стоимости сопоставимых GPU Nvidia.
По данным исследования, 47% респондентов ожидают удорожания GPU-ресурсов в ближайшие 12 месяцев, а 45% считают, что их значение для бизнеса будет расти. Развертывать крупные модели на собственной инфраструктуре становится дороже, однако единого ценового предела, после которого рынок потеряет интерес к ИИ, нет: если покупка оборудования перестает окупаться, компании выбирают более компактные модели, оптимизируют вычисления или переходят в облако.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Купить втридорога. Стоимость запуска LLM в России поднялась за последний год в 2,8 раза | 0 | 13.97 | 19-08-2026 |
| 2 | В России зафиксирован почти трехкратный рост стоимости внедрения ИИ | 1 | 15.17 | 19-08-2026 |
| 3 | В России зафиксирован почти трехкратный рост стоимости внедрения ИИ | 1 | 15.17 | 19-08-2026 |
| 4 | В России зафиксирован почти трехкратный рост стоимости внедрения ИИ | 1 | 15.17 | 19-08-2026 |
| 5 | Потребление китайских LLM в России выросло более чем в 11 раз | 0 | 13.81 | 14-08-2026 |
| 6 | "Ведомости": в России с начала года стоимость серверов выросла примерно на 25% | 0 | 18.33 | 19-08-2026 |
| 7 | Цена стойки в российских ЦОДах резко пошла вверх. Рост достигает 30% | 1 | 14.85 | 06-08-2026 |
| 8 | Цена стойки в российских ЦОДах резко пошла вверх. Рост достигает 30% | 1 | 14.85 | 06-08-2026 |
| 9 | Цена стойки в российских ЦОДах резко пошла вверх. Рост достигает 30% | 1 | 14.85 | 06-08-2026 |
| 10 | Nvidia поднимет цены на ИИ-ускорители на более чем 15 % со следующего года | 0 | 10.35 | 23-08-2026 |