GigaChat 3.5 Reasoning — флагманская мультимодальная нейросеть «Сбера» с режимом рассуждений. Она не отвечает на сложный вопрос сразу: сначала разбирает задачу на этапы, определяет план решения, при необходимости обращается к поиску и другим инструментам, ищет ошибки в промежуточных результатах и только после этого формирует ответ. Пользователь может сам решить, когда нужно рассуждение, и включить режим отдельной кнопкой. На простой вопрос модель отвечает сразу, а для сложной задачи может использовать десятки тысяч токенов на поиск решения.
Режим рассуждений — это подход, при котором модель перед финальным ответом выстраивает цепочку промежуточных шагов. Обычные нейросети без такого режима на сложных задачах дают быстрый, но неполный ответ, просто не размышляя над ними. GigaChat 3.5 Reasoning целенаправленно обучили рассуждать, взяв за основу базовую GigaChat 3.5 Ultra. Для обучения модель решала математические и кодовые задачи разными способами, раскладывая их на последовательные шаги. Автоматическая проверка определяла, какой вариант рассуждения привёл к правильному ответу, и закрепляла именно такие пути решения. Так она научилась не только выстраивать последовательность действий, но и самостоятельно решать, когда обратиться к внешнему инструменту или пересмотреть предыдущий шаг.
| Бенчмарк | Без режима рассуждений | GigaChat 3.5 Ultra Reasoning |
|---|---|---|
| IFBench | 44 | 77 |
| Natural Plan | 64 | 80 |
| Live Code Bench v6 | 56 | 85 |
По ключевым направлениям — следованию сложным инструкциям, планированию и написанию кода — GigaChat 3.5 Ultra Reasoning вплотную приблизился к лучшим мировым моделям. В бенчмарке IFBench результат вырос с 44 до 77 баллов, на Natural Plan — с 64 до 80, на Live Code Bench v6 — с 56 до 85. Это заметный рост по сравнению с версией без режима рассуждений. При этом модель экономна: на решение математических задач она тратит в среднем на 37% меньше токенов, чем DeepSeek V4 Flash Preview, при сопоставимом качестве ответов.
На бенчмарке IFBench результат вырос с 44 до 77 баллов, на Natural Plan — с 64 до 80, на Live Code Bench v6 — с 56 до 85.
Практическая польза рассуждений проявляется там, где недостаточно одного действия или простого поиска информации. Модель может найти противоречия между пунктами договора, провести финансовые расчёты или разобраться в сложной ошибке в коде. В агентных сценариях, где нужно последовательно выполнить несколько действий, новая версия справляется лучше. Например, при организации поездки модель может уточнить недостающие параметры, подобрать рейс и отель, проверить, укладывается ли маршрут в бюджет, а при обнаружении противоречия — перестроить план.
Наиболее полезной рассуждающая модель будет в финансах и банкинге — прогнозирование сценариев, проверка сделок на соответствие нормативным требованиям; в юриспруденции — поиск противоречий в договорах, проверка документов на соответствие регламенту или прецедентам; в разработке ПО — поиск и исправление багов, выбор архитектуры с учётом скорости, цены и надёжности; в логистике и планировании — построение маршрутов и расписаний с учётом сроков, бюджета и доступных ресурсов; в образовании — пошаговый разбор задач по математике, физике и программированию с проверкой каждого шага; в науке и аналитике данных — анализ данных в несколько этапов, расчёты и проверка гипотез; в поддержке клиентов — уточнение деталей у клиента и проверка данных в разных системах перед ответом.
Антон Фролов, старший вице-президент, руководитель блока «Развитие генеративного ИИ» Сбербанка, сказал: «Сегодня от ИИ ждут не просто быстрого ответа, а способности разобраться в сложной задаче. Теперь GigaChat способен самостоятельно разложить задачу на этапы, понять, каких данных не хватает, проверить промежуточные выводы и при необходимости изменить ход решения. Такой подход особенно важен для агентных сценариев, программирования, аналитики — везде, где результат зависит от целой последовательности решений. Это важный шаг к ИИ, который способен самостоятельно выстраивать путь к результату, действовать проактивно и взаимодействовать с другими сервисами. GigaChat — единственная российская модель с режимом рассуждений».
Флагманская модель уже доступна всем пользователям «ГигаЧат», а разработчикам — бесплатно по лицензии MIT для интеграции в свои продукты. Модель станет доступна бизнесу по API в ближайшее время.
