
Летом коммерческий доступ открыли к GigaChat 3.5 Ultra, теперь же в каталоге сервиса Evolution Foundation Models стала доступна версия отечественной нейросети с режимом рассуждений GigaChat 3.5 Reasoning. Модель ориентирована на задачи, связанные с бизнесом, финансами и юриспруденцией и подключается по OpenAI-совместимому API без самостоятельного развертывания инфраструктуры для инференса. Стоимость составляет 96 ₽ за 1 млн входных и 289 ₽ за 1 млн выходных токенов.
GigaChat 3.5 Reasoning построена на той же архитектурной базе, что и уже доступная в сервисе GigaChat 3.5 Ultra. У обеих моделей 432 млрд параметров суммарно и около 28 млрд активных параметров на токен, гибридный механизм внимания MLA + GatedDeltaNet и контекстное окно до 262 тысяч токенов. Поэтому отличие новинки не в размере или длине контекста, а в способе дообучения и решения задач.
Модель дополнительно дообучили с помощью online RL — обучения с подкреплением на решениях, которые она генерировала сама. Разработчики отдельно обучали шесть версий для разных классов задач: математики и естественных наук, генерации кода, работы с репозиториями, агентных сценариев, диалога и следования инструкциям. Для проверки применяли разные сигналы: от сверки финального ответа и запуска тестов до оценки состояния среды после вызова инструментов. Затем полученные навыки объединили в одной модели методом on-policy distillation.
На опубликованных разработчиками тестах наиболее заметный прирост относительно GigaChat 3.5 Ultra Instruct получен в программировании, планировании и следовании инструкциям. Результат IFBench вырос с 43,66 до 77 баллов, Natural Plan — с 64 до 80,19, а LiveCodeBench v6 — с 56,2 до 85,4. Это сравнение показывает преимущество Reasoning в конкретных многошаговых задачах.