Российский бизнес кратно увеличил потребление зарубежных больших языковых моделей (LLM), при этом основной спрос смещается в сторону китайских разработчиков. По данным «Ъ», на платформе Yandex AI Studio за первое полугодие 2026 года потребили 597 млрд токенов, что в 18 раз больше, чем за аналогичный период прошлого года. При этом 54% токенов пришлось на модели «Яндекса», а на втором и третьем местах — Qwen (21,2%) и DeepSeek (13,5%).

В MWS Cloud сообщили, что потребление китайских LLM на платформе MWS GPT в первом полугодии 2026 года выросло в 11 раз по сравнению со всем 2025 годом, достигнув 400 млрд токенов. Лидером по потреблению токенов в 2026 году остается модель Qwen (261,1 млрд токенов).

На LLM‑платформе Cloud.ru также фиксируют рост за первые неполные восемь месяцев 2026 года в 18 раз, однако абсолютные данные компания не раскрывает. При этом «существенная часть спроса приходится на китайские модели».

Почему бизнес выбирает китайские модели

Участники рынка объясняют рост спроса на китайские LLM несколькими факторами:

  • доступность по цене;
  • открытость моделей;
  • возможность развернуть их в закрытом контуре или в российских облаках.

Прогноз рынка LLM в России

Весь рынок LLM в России в 2026 году, по прогнозам MWS Cloud, вырастет на 35% и составит порядка 19,6 млрд рублей.