Сбер представил GigaChat 3.5 Reasoning — нейросеть с режимом рассуждений
Главная Новости Сбер разработал новую reasoning-нейросеть, которая...
5 мин чтения
3
Поделиться:

Сбер разработал новую reasoning-нейросеть, которая уже доступна пользователям и разработчикам

Сбер разработал новую reasoning-нейросеть, которая уже доступна пользователям и разработчикам Сбер представил GigaChat 3.5 Reasoning — новую флагманскую нейросеть с режимом рассуждений. В отличие от обычных моделей, она не спешит сразу отвечать на сложный вопрос: сначала разбирает задачу на этапы, определяет план решения, при необходимости обращается к поиску и другим инструментам, ищет ошибки в своих промежуточных результатах и только после этого формирует итоговый ответ. Модель уже доступна всем пользователям ГигаЧата, а разработчикам — бесплатно по лицензии MIT для интеграции в свои продукты. Бизнесу модель станет доступна по API в ближайшее время. GigaChat 3.5 Reasoning — единственная российская открытая модель, которая последовательно рассуждает перед ответом, работает с цепочками задач и способна исправлять собственные ошибки. При этом она быстрая и экономная: решает задачи с меньшими ресурсами, существенно экономя токены на рассуждение по сравнению с ведущими открытыми нейросетями.

Зачем нужен режим рассуждений

Рассуждения особенно полезны в задачах, где недостаточно одного действия или простого поиска информации. Например, модель может:
  • найти противоречия между пунктами договора — что критически важно для юристов и финансистов;
  • провести финансовые расчёты — с проверкой каждого шага;
  • разобраться в сложной ошибке в коде — не просто указать на баг, а объяснить причину и предложить исправление;
  • построить маршрут с учётом бюджета и сроков — как в логистике, так и в планировании поездок.
Пользователь может сам определить, когда требуется рассуждение, и включить режим отдельной кнопкой. На простой вопрос модель отвечает сразу, а для сложной задачи может использовать десятки тысяч токенов на поиск решения.

Как это работает: примеры и сценарии

Новая версия лучше справляется с написанием кода и агентными сценариями, в которых необходимо последовательно выполнить несколько действий. Например, при организации поездки модель может:
  1. уточнить недостающие параметры (даты, бюджет, предпочтения);
  2. подобрать рейс и отель;
  3. проверить, укладывается ли маршрут в бюджет;
  4. при обнаружении противоречия — перестроить план.
Такой подход особенно важен для агентных сценариев, программирования и аналитики — везде, где результат зависит от целой последовательности решений.

Результаты и бенчмарки

Благодаря поддержке рассуждений качество GigaChat выросло почти по всем замерам. Наиболее заметный прогресс — в агентских задачах, работе с функциями и инструментами, программировании и задачах со сложной логикой. По ключевым направлениям — следованию сложным инструкциям, планированию и написанию кода — GigaChat 3.5 Ultra Reasoning вплотную приблизился к лучшим мировым моделям. Динамика по бенчмаркам:
  • IFBench (следование инструкциям) — рост с 44 до 77 баллов;
  • Natural Plan (планирование) — с 64 до 80;
  • Live Code Bench v6 (написание кода) — с 56 до 85.
При этом GigaChat 3.5 Reasoning — экономная модель: на рассуждения она тратит существенно меньше токенов, чем ведущие открытые модели при сопоставимом качестве ответов. Например, на решение математических задач она тратит в среднем на 37% меньше токенов, чем DeepSeek V4 Flash Preview.

Где модель будет наиболее полезна

Рассуждающая модель будет наиболее востребована в следующих сферах:
  • Финансы и банкинг — прогнозирование сценариев, проверка сделок на соответствие нормативным требованиям;
  • Юриспруденция — поиск противоречий в договорах, проверка документов на соответствие регламенту или прецедентам;
  • Разработка ПО — поиск и исправление багов, выбор архитектуры с учётом скорости, цены и надёжности;
  • Логистика и планирование — построение маршрутов и расписаний с учётом сроков, бюджета и ресурсов;
  • Образование — пошаговый разбор задач по математике, физике и программированию с проверкой каждого шага;
  • Наука и аналитика данных — анализ данных в несколько этапов: расчёты и проверка гипотез;
  • Поддержка клиентов — уточнение деталей у клиента и проверка данных в разных системах перед ответом.

Как обучали новую модель

Нейросети без режима рассуждения на сложных задачах могут давать быстрый, но неполный ответ — просто не размышляя над ними. Новую модель целенаправленно обучили рассуждать, взяв за основу базовую GigaChat 3.5 Ultra. Для обучения модель решала математические и кодовые задачи разными способами, раскладывая их на последовательные шаги. Автоматическая проверка определяла, какой вариант рассуждения привёл к правильному ответу, и закрепляла именно такие пути решения. Так она научилась не только выстраивать последовательность действий, но и самостоятельно решать, когда обратиться к внешнему инструменту или пересмотреть предыдущий шаг. GigaChat 3.5 Reasoning использует собственную архитектуру с технологией линейного внимания. Она помогает эффективнее работать с длинным контекстом: вместо того чтобы повторно сопоставлять каждый новый запрос со всем предыдущим текстом, модель запоминает его ключевое содержание и дополняет его по мере обработки информации.

Комментарий разработчиков

Антон Фролов, старший вице-президент, руководитель блока «Развитие генеративного ИИ» Сбербанка, отметил, что сегодня от ИИ ждут не просто быстрого ответа, а способности разобраться в сложной задаче.
«Теперь GigaChat способен самостоятельно разложить задачу на этапы, понять, каких данных не хватает, проверить промежуточные выводы и при необходимости изменить ход решения. Такой подход особенно важен для агентных сценариев, программирования, аналитики — везде, где результат зависит от целой последовательности решений. Это важный шаг к ИИ, который способен самостоятельно выстраивать путь к результату, действовать проактивно и взаимодействовать с другими сервисами. GigaChat — единственная российская модель с режимом рассуждений», — подчеркнул Антон Фролов.
📌 Главный вывод: Сбер представил GigaChat 3.5 Reasoning — первую российскую открытую нейросеть с режимом рассуждений. Она разбирает задачу на этапы, проверяет промежуточные выводы и исправляет ошибки. Модель доступна пользователям и разработчикам (лицензия MIT), бизнесу — по API. По бенчмаркам она вплотную приблизилась к мировым лидерам, при этом тратит на 37% меньше токенов, чем DeepSeek V4 Flash Preview.
Мнение автора: Выход GigaChat 3.5 Reasoning — это серьёзная заявка Сбера на лидерство в области генеративного ИИ. Режим рассуждений — не просто маркетинговая фишка: это принципиально другой подход к решению задач, который позволяет модели не «галлюцинировать», а выстраивать логические цепочки и проверять себя. Особенно ценно, что модель открыта для разработчиков по лицензии MIT — это стимулирует создание новых продуктов на её основе. Экономичность тоже важна: в условиях, когда вычислительные ресурсы стоят дорого, способность тратить на 37% меньше токенов — это реальное конкурентное преимущество. Если Сбер продолжит развивать это направление, у российского бизнеса появится мощный инструмент для автоматизации сложных процессов — от юридических проверок до разработки ПО.
Она разбирает задачу на этапы, проверяет промежуточные выводы и исправляет ошибки.
— Из этой статьи
Что вы думаете об этой статье?
Подписаться на Telegram
Наша почта admin@kartarasrochki.ru
Режим работы Круглосуточно