Byte/RE ИТ-издание

MWS Cloud о потреблении китайских LLM в России

Компания MWS Cloud (входит в МТС Web Services, MWS) обнародовала сведения о потреблении китайских больших языковых моделей российскими компаниями, полученные путем анализа данных платформ MWS GPT Model Hub и MWS GPT. В первом полугодии 2026 г. объем потребления более чем в 11 раз превысил показатель за весь 2025 г. Наиболее востребованными стали семейства Qwen, GLM и Kimi.

В 2025 г. на работу с китайскими генеративными моделями российские компании израсходовали 39,1 млрд токенов, а в первом полугодии 2026 г. потребление превысило 400 млрд токенов, увеличившись в 11,3 раза.

Основными пользователями платформы, по данным MWS Cloud,  являются представители крупного бизнеса. Они чаще всего применяют LLM для автоматизации клиентского взаимодействия: запускают чат-ботов для круглосуточной поддержки без участия оператора, генерируют и персонализируют маркетинговый контент, от текстов рассылок и описаний товаров до рекламных объявлений, а также автоматизируют анализ обратной связи: выявляют тональность отзывов, категоризируют запросы и формируют сводные отчеты.

На фоне растущего спроса и выхода новых моделей MWS Cloud почти вдвое расширила число больших языковых моделей в сервисе MWS GPT Model Hub, доведя их количество до 17. Главное пополнение платформы – GLM 5.2, опенсорс LLM от компании Z.AI, которая была признана лучшей LLM в агентских задачах. Кроме того, в сервисе появились первые модели распознавания речи (ASR) и синтеза речи (TTS), реранкеры для повышения качества поиска и RAG-пайплайнов. Среди новых LLM также Kimi K2.6, Qwen3.6, Gemma 4, GPT OSS и другие. Каталог из 17 моделей дает разработчикам возможность подбирать модель под конкретную задачу с учетом требований к качеству, скорости и стоимости. Все модели доступны через единый OpenAI-совместимый API.

Сервис доступен в рамках платформы MWS Cloud Platform.

Вам также могут понравиться