5 языковых моделей для корпоративных задач в контуре РФ
Российской компании доступны две группы моделей: российские — GigaChat, YandexGPT и Cotype, и открытые, которые разворачиваются в своей инфраструктуре, — DeepSeek и Qwen.
Выбор идёт по задаче: разбор документов, классификация обращений, длинный контекст, работа с кодом.
На опыте WAIVE хороший результат на корпоративных задачах дают DeepSeek и Qwen.
Разбор собран по открытым материалам вендоров на октябрь 2026 года и по проектам WAIVE. Сравнение моделей между собой по одному баллу качества смысла не имеет: одна и та же модель даёт разный результат на разборе договоров и на классификации обращений.
5 моделей
GigaChat, Сбер
Линейка от Lite до Ultra, российская разработка, запись в реестре отечественного ПО.
- Поставляется облаком, программно-аппаратным комплексом и в гибридной схеме.
- Флагманская модель Ultra доступна бизнесу с апреля 2026 года.
YandexGPT, Яндекс
Модели Яндекса в составе Yandex AI Studio, работают в связке с поиском, подтверждённым ссылками, и с рассуждающими сценариями.
- Доступны через облако Яндекса.
Cotype, MWS AI
Линейка моделей МТС.
- В июле 2026 года вышла Cotype Pro 3 на 27 млрд параметров для многошаговых задач и Cotype Light 3 на 9 млрд. Устанавливается в закрытом контуре.
DeepSeek
Открытая модель, разворачивается в инфраструктуре компании.
- На проектах WAIVE показывает хороший результат на разборе документов и на задачах с длинными инструкциями.
Qwen
Семейство открытых моделей разных размеров.
- Младшие модели закрывают классификацию и извлечение полей при небольшом расходе, старшие — длинный контекст и сложный разбор.
Какая модель под какую задачу
| Задача | Что берём | Причина выбора |
|---|---|---|
| Разбор договоров и регламентов | DeepSeek | Устойчиво держит длинную инструкцию и формат ответа |
| Классификация обращений и извлечение полей | Младшие модели Qwen | Расход на запрос ниже при сопоставимом качестве на простой задаче |
| Документы на сотни страниц | Старшие модели Qwen и модели с длинным контекстом | Документ помещается в один запрос без разрезания |
| Задачи с требованием российской разработки | GigaChat, YandexGPT, Cotype | Запись в реестре отечественного ПО и обработка в России |
| Работа с кодом | Модели линейки Qwen-Coder | Обучены на задачах разработки |
Выбор модели закрывается замером, а не обсуждением.
- Один и тот же проверочный набор из 30-50 вопросов прогоняется на нескольких моделях, сравниваются доля точных ответов, расход на запрос и время ответа.
Что учитывать помимо качества
- Место обработки: облако вендора в России, контур компании или программно-аппаратный комплекс.
- Расход на запрос: стоимость складывается из объёма входного запроса и длины ответа, на больших документах разница между моделями заметна.
- Длина контекста: от неё зависит, помещается ли документ в один запрос.
- Скорость ответа: для первой линии поддержки она важнее доли сложных задач.
- Порядок смены модели: при подключении через каталог моделей замена идёт без правок на стороне сотрудников.
Схема с несколькими моделями
В работе компании редко нужна одна модель:
- Классификация обращений: младшая модель с низким расходом на запрос.
- Разбор документов: модель с длинным контекстом.
- Ответы сотрудникам: модель, которая держит формат и инструкцию.
Через Роутер моделей WAIVE доступен весь каталог: любую модель можно прогнать на своих вопросах и выбрать по замеру.
Частые вопросы
- Какие языковые модели доступны российским компаниям?
- Российские GigaChat, YandexGPT и Cotype, а также открытые модели DeepSeek и Qwen, которые разворачиваются в инфраструктуре компании.
- Какая языковая модель лучше для корпоративных задач?
- Выбор зависит от задачи. На опыте WAIVE хороший результат на корпоративных задачах дают DeepSeek и Qwen; задачи с требованием российской разработки закрывают GigaChat, YandexGPT и Cotype.
- Как сравнить модели между собой?
- Проверочным набором из 30-50 вопросов компании: один и тот же набор прогоняется на каждой модели, сравниваются доля точных ответов, расход на запрос и время ответа.
- Можно ли подключить несколько моделей сразу?
- Да. Через Роутер моделей WAIVE доступен каталог моделей с одной точкой подключения: задачи распределяются по моделям, замена идёт без правок на стороне сотрудников.
- Где обрабатываются данные при работе с моделью?
- В российском облаке вендора, в контуре компании или на программно-аппаратном комплексе. Схема фиксируется до запуска: место обработки запроса и состав передаваемых данных указываются в договоре.