Byte/RE ИТ-издание

Новая флагманская модель GigaChat от Сбера

Сбер представил свою новую флагманскую модель – GigaChat 3.5 Ultra. Она стала умнее, генерирует длинный текст до 4 раз быстрее, потребляет меньше ресурсов и почти вдвое компактнее предыдущей версии. Обновленная модель лучше решает задачи, связанные с написанием кода, математикой, работой с длинными текстами и автономными агентными сценариями. В основе модели – собственная архитектура с технологией линейного внимания, разработанная командой Сбера.

Улучшенной моделью может пользоваться любой желающий. В ИИ-помощнике ГигаЧат она доступна всем, кто хочет применять ИИ для личных и рабочих задач. В open source она бесплатно доступна разработчикам по всему миру для встраивания в свои сервисы и создания ИИ-агентов.

В задачах кодирования и математики модель увереннее генерирует и проверяет код, точнее решает математические задачи и финансовые расчеты, работает с числами. Ответы стали точнее, структурнее и удобнее для восприятия. Все это позволяет встраивать модель в реальный рабочий процесс разработчика, аналитика или инженера.

В плане чтения и анализа длинных текстов модель эффективно анализирует контракты, техрегламенты, отчеты и другие объемные документы без потери точности и контекста – за счет архитектуры линейного внимания она не перечитывает текст заново, а накапливает контекст постепенно, как человек, который помнит суть разговора. Скорость работы с длинными текстами выросла до четырех раз.

С точки зрения автономности модели можно поставить задачу, и она сама найдет информацию, напишет и выполнит код, обратится к нужному сервису и вернет готовый результат. Это позволяет автоматизировать рутину: мониторинг, обработку данных, подготовку отчетов по расписанию.

На тестах, которые измеряют способность ИИ решать задачи по программированию, математике, выполнению сложных многошаговых заданий и качество русскоязычного диалога, GigaChat 3.5 Ultra превзошла предыдущую флагманскую модель Сбера, а по ряду показателей приблизилась к результатам сильных открытых моделей, например, к DeepSeek 3.2, при этом будучи почти вдвое компактнее.

GigaChat 3.5 Ultra – разработка Сбера: команда создала архитектуру с применением технологии линейного внимания. В отличие от классического «внимания» ИИ-моделей, которое при каждом новом слове заново сверяет его со всем предыдущим текстом, линейное внимание один раз «запоминает» суть прочитанного и дальше просто дополняет эту память – примерно как человек, который держит в голове краткий пересказ книги, а не перелистывает ее с начала при каждой странице. GigaChat 3.5 Ultra, отмечают в компании, – одна из самых больших моделей с линейным вниманием среди всех, что выходили в опенсорс.

При обучении модели акцент сделан на натуральных, созданных человеком текстах, прошедших многоуровневую классификацию и фильтрацию – собранный увеличенный датасет позволил достичь лучших метрик. Модель построена в архитектуре MoE (Mixture of Experts) и примерно вдвое компактнее предыдущей версии GigaChat Ultra, что снижает потребление вычислительных ресурсов и позволяет разворачивать ее на более доступном оборудовании.

Вам также могут понравиться