Инновации в сфере искусственного интеллекта

«Сбер» анонсировал выпуск GigaChat 3.5 Reasoning, новой версии своей мультимодальной нейросети, которая позиционируется как первая российская открытая модель с полноценным режимом рассуждений. Эта модель, обученная с использованием технологии online RL (Reinforcement Learning), способна последовательно рассуждать перед формированием ответа, обрабатывать цепочки задач и корректировать собственные ошибки.

Особенности архитектуры и процесса обучения

Ключевым изменением в методологии обучения GigaChat 3.5 Reasoning стало полное прохождение модели через процесс online RL после этапа SFT (Supervised Fine-Tuning). Вместо единого домена или финальной стадии, обучение включало шесть отдельных экспертов, каждый из которых специализировался на конкретных областях, таких как математика, программирование и агентские функции. Каждый эксперт имел свою систему вознаграждений, после чего все они были интегрированы обратно в единую модель. Разработка и внедрение этой сложной архитектуры заняли более девяти месяцев.

Значимость для российского ИИ-ландшафта

Представление GigaChat 3.5 Reasoning подчеркивает стремление «Сбера» к развитию передовых технологий в области искусственного интеллекта. Заявленные возможности по рассуждению и самокоррекции делают ее значимым шагом для российского открытого ИИ-сообщества, предоставляя инструмент с улучшенными когнитивными способностями.