Сбер представил новую версию нейросети GigaChat 3.5 Reasoning — она получила режим рассуждений. Об этом Russian Business сообщили в компании. В отличие от обычных ИИ-моделей, которые сразу формируют ответ, новая версия сначала разбирает задачу на этапы, определяет план действий, при необходимости обращается к поиску и другим инструментам, а затем проверяет полученные результаты.
По данным компании, модель может самостоятельно планировать решение сложных задач, анализировать промежуточные результаты и исправлять ошибки. Разработчики смогут бесплатно интегрировать модель в свои продукты, а доступ по API для бизнеса появится в ближайшее время.
Что такое режим рассуждений
Режим рассуждений — это функция, при которой модель перед выдачей ответа «думает»: разбивает сложную задачу на пошаговый план и при необходимости обращается к внешним инструментам. Так описывает её исходное издание со ссылкой на компанию.
Нейросеть сможет выполнять задачи из нескольких последовательных действий. Среди примеров, приведённых в сообщении: анализ договоров на противоречия, финансовые расчёты, поиск ошибок в коде и планирование поездки с учётом бюджета и ограничений.
Пользователь сам включает режим рассуждений
Режим рассуждений можно включить самостоятельно — для сложных запросов. Для простых вопросов модель продолжит отвечать без дополнительного анализа, чтобы не тратить вычислительные ресурсы.
Старший вице-президент, руководитель блока «Развитие генеративного ИИ» Сбербанка Антон Фролов отметил, что сегодня от ИИ ждут не просто быстрого ответа, а способности разобраться в сложной задаче.
«Теперь GigaChat способен самостоятельно разложить задачу на этапы, понять, каких данных не хватает, проверить промежуточные выводы и при необходимости изменить ход решения», — отметил старший вице-президент, руководитель блока «Развитие генеративного ИИ» Сбербанка Антон Фролов.
Результаты в бенчмарках
По данным Сбера, после добавления режима рассуждений качество GigaChat выросло в задачах на логику, программирование, планирование и взаимодействие с инструментами. В бенчмарке IFBench результат модели вырос с 44 до 77 баллов, на Natural Plan — с 64 до 80, а на Live Code Bench v6 — с 56 до 85.
При этом GigaChat 3.5 Reasoning расходует меньше ресурсов по сравнению с рядом открытых моделей. Например, при решении математических задач она использует в среднем на 37% меньше токенов, чем DeepSeek V4 Flash Preview.
Что это значит
Сбер расширяет линейку GigaChat моделью с режимом рассуждений — подходом, который уже применяется в ряде ИИ-систем: модель тратит дополнительные вычисления на планирование и проверку, а не выдаёт ответ сразу. Заявленные метрики — внутренние данные компании, поэтому оценивать их стоит с учётом этого. Для разработчиков важны два практических момента: бесплатная интеграция модели в свои продукты и скорое появление доступа по API для бизнеса.

Комментарии · 0
Войдите, чтобы участвовать в обсуждении.