MWS AI выпустила Cotype Pro 3, мультимодальную модель для агентских сценариев

MWS AI представила новую флагманскую модель линейки Cotype — Pro 3 (27 млрд параметров). Ранее в этом году вышла компактная версия — Light 3 (9 млрд параметров). Обе модели мультимодальные: работают с текстом и изображениями и ориентированы в первую очередь на построение многошаговых ИИ-агентов и мультиагентных систем.
Коротко о технических характеристиках:
Контекстное окно обеих моделей — 262 тысячи токенов (примерно 600 страниц текста, то есть весь пакет договоров по сделке или годовой отчёт с приложениями можно держать в памяти целиком).
Обе модели разворачиваются в закрытом контуре на серверах заказчика, в том числе под управлением Astra Linux, могут быть дообучены на корпоративных данных клиента.
Минимальное железо — видеокарта A100.
Поддерживается квантование и MTP (multi-token prediction, одновременное предсказание нескольких токенов) — для более высокой скорости генерации на менее мощном железе без потери качества.
Доступны отдельно или в составе MWS AI Agents Platform.
Подтверждена совместимость со всеми компонентами отечественных программно-аппаратных комплексов.
Обучение моделей семейства Cotype проводится на мощностях MWS Cloud.
Главная фишка моделей - стабильность в агентских сценариях и русском языке
Готовых бенчмарков под корпоративные агентские сценарии на русском рынке практически нет, поэтому в MWS AI собрали собственный — из 178 задач. Каждая задача помещает модель в одну из пяти рабочих ролей:
оператор поддержки — вопросы по услугам, подпискам и списаниям абонента;
консультант по тарифам — подбор и смена тарифа под фактическое потребление;
кадровый специалист — расчёт отпускных и больничных, работа с документами;
аналитик по компаниям — досье на юрлицо по ИНН: финансы, руководители, связи с другими организациями;
инспектор налоговых рисков — расследование схем переноса бизнеса между компаниями и решение о назначении проверки.
В каждом сценарии проверяется не только правильность ответа, но и то, как модель пользуется инструментами и соблюдает бизнес-правила.
Помимо доли полностью решённых задач, отдельно считали воспроизводимость — насколько стабильно модель выдаёт одно и то же решение при повторных обращениях к одной и той же задаче. Логика простая: для продакшн-агента куда важнее не пиковый результат на бенчмарке, а гарантия, что при тысячном обращении будет тот же корректный ответ, что и при первом.
Результаты (полнота решения / воспроизводимость):
Cotype Pro 3: 92,2% / 79,1%
Cotype Light 3: 88,6% / 73,9%
Cotype Pro 2.6: 80,5% / 62,5%
Отдельно измеряли устойчивость генерации на русском (отсутствие случайных переключений на другой язык, повторов и искажений текста). Тест прогнали на корпусе почти в 304 тысячи слов, модель Pro 3 выдала 99,79% текста на русском без языкового дрейфа, Light 3 — 99,87%.
Заказ демо для бизнеса на сайте





