Блог
4 минуты чтенияязыковые моделисправочник

5 языковых моделей для корпоративных задач в контуре РФ

Российской компании доступны две группы моделей: российские — GigaChat, YandexGPT и Cotype, и открытые, которые разворачиваются в своей инфраструктуре, — DeepSeek и Qwen.

Выбор идёт по задаче: разбор документов, классификация обращений, длинный контекст, работа с кодом.

На опыте WAIVE хороший результат на корпоративных задачах дают DeepSeek и Qwen.

Разбор собран по открытым материалам вендоров на октябрь 2026 года и по проектам WAIVE. Сравнение моделей между собой по одному баллу качества смысла не имеет: одна и та же модель даёт разный результат на разборе договоров и на классификации обращений.

5 моделей

GigaChat, Сбер

Линейка от Lite до Ultra, российская разработка, запись в реестре отечественного ПО.

  • Поставляется облаком, программно-аппаратным комплексом и в гибридной схеме.
  • Флагманская модель Ultra доступна бизнесу с апреля 2026 года.

YandexGPT, Яндекс

Модели Яндекса в составе Yandex AI Studio, работают в связке с поиском, подтверждённым ссылками, и с рассуждающими сценариями.

  • Доступны через облако Яндекса.

Cotype, MWS AI

Линейка моделей МТС.

  • В июле 2026 года вышла Cotype Pro 3 на 27 млрд параметров для многошаговых задач и Cotype Light 3 на 9 млрд. Устанавливается в закрытом контуре.

DeepSeek

Открытая модель, разворачивается в инфраструктуре компании.

  • На проектах WAIVE показывает хороший результат на разборе документов и на задачах с длинными инструкциями.

Qwen

Семейство открытых моделей разных размеров.

  • Младшие модели закрывают классификацию и извлечение полей при небольшом расходе, старшие — длинный контекст и сложный разбор.

Какая модель под какую задачу

ЗадачаЧто берёмПричина выбора
Разбор договоров и регламентовDeepSeekУстойчиво держит длинную инструкцию и формат ответа
Классификация обращений и извлечение полейМладшие модели QwenРасход на запрос ниже при сопоставимом качестве на простой задаче
Документы на сотни страницСтаршие модели Qwen и модели с длинным контекстомДокумент помещается в один запрос без разрезания
Задачи с требованием российской разработкиGigaChat, YandexGPT, CotypeЗапись в реестре отечественного ПО и обработка в России
Работа с кодомМодели линейки Qwen-CoderОбучены на задачах разработки

Выбор модели закрывается замером, а не обсуждением.

  • Один и тот же проверочный набор из 30-50 вопросов прогоняется на нескольких моделях, сравниваются доля точных ответов, расход на запрос и время ответа.

Что учитывать помимо качества

  • Место обработки: облако вендора в России, контур компании или программно-аппаратный комплекс.
  • Расход на запрос: стоимость складывается из объёма входного запроса и длины ответа, на больших документах разница между моделями заметна.
  • Длина контекста: от неё зависит, помещается ли документ в один запрос.
  • Скорость ответа: для первой линии поддержки она важнее доли сложных задач.
  • Порядок смены модели: при подключении через каталог моделей замена идёт без правок на стороне сотрудников.

Схема с несколькими моделями

В работе компании редко нужна одна модель:

  • Классификация обращений: младшая модель с низким расходом на запрос.
  • Разбор документов: модель с длинным контекстом.
  • Ответы сотрудникам: модель, которая держит формат и инструкцию.

Через Роутер моделей WAIVE доступен весь каталог: любую модель можно прогнать на своих вопросах и выбрать по замеру.

30-50
вопросов в проверочном наборе
3 показателя
доля точных ответов, расход на запрос, время ответа
1 запрос
одна формулировка прогоняется на всех моделях каталога

Частые вопросы

Какие языковые модели доступны российским компаниям?
Российские GigaChat, YandexGPT и Cotype, а также открытые модели DeepSeek и Qwen, которые разворачиваются в инфраструктуре компании.
Какая языковая модель лучше для корпоративных задач?
Выбор зависит от задачи. На опыте WAIVE хороший результат на корпоративных задачах дают DeepSeek и Qwen; задачи с требованием российской разработки закрывают GigaChat, YandexGPT и Cotype.
Как сравнить модели между собой?
Проверочным набором из 30-50 вопросов компании: один и тот же набор прогоняется на каждой модели, сравниваются доля точных ответов, расход на запрос и время ответа.
Можно ли подключить несколько моделей сразу?
Да. Через Роутер моделей WAIVE доступен каталог моделей с одной точкой подключения: задачи распределяются по моделям, замена идёт без правок на стороне сотрудников.
Где обрабатываются данные при работе с моделью?
В российском облаке вендора, в контуре компании или на программно-аппаратном комплексе. Схема фиксируется до запуска: место обработки запроса и состав передаваемых данных указываются в договоре.

Читать дальше