Byte/RE ИТ-издание

Нейросеть Kandinsky версии 2.2 

Сбер представил новую версию своей генеративной модели – Kandinsky 2.2, с помощью которой можно создавать фотореалистичные изображения с более высоким разрешением и изменять соотношение сторон при генерации. Значительного прироста качества удалось достигнуть при создании портретов. Для дообучения нейросети использовался датасет в размере 1,5 млрд пар «текст – изображение». Это на 300 млн больше, чем в версии Kandinsky 2.1.

Нейросеть разработали и обучили исследователи Sber AI при партнерской поддержке ученых из Института искусственного интеллекта AIRI на объединенном датасете Sber AI и компании SberDevices.

Новая версия модели научилась генерировать стикеры, из которых можно собирать полноценные стикерпаки в Telegram. Также бот Kandinsky 2.2 теперь способен изменять по текстовому описанию отдельные объекты или элементы на изображениях, сохраняя композицию исходной иллюстрации. Это стало возможным благодаря внедрению в модель специального структурного блока управляемых изменений – ControlNet.

Kandinsky 2.2 понимает запросы на русском и английском языках, умеет рисовать более чем в 20 стилях, смешивать несколько рисунков, стилизовать изображение по текстовому описанию, генерировать изображения, похожие на заданные, дорисовывать недостающие части картинки (inpainting), создавать картины в режиме бесконечного полотна (outpainting).

Как отмечают в Сбере, новая версия нейросети уже не просто пытается подражать творчеству человека, а способна создавать новые художественные смыслы и интерпретации. Как и предыдущая версия, Kandinsky 2.2 находится в открытом доступе, протестировать ее можно совершенно бесплатно.

Оценить возможности нейросети можно на промостранице модели, на платформе FusionBrain.AI, в Telegram-боте и боте ВКонтакте, а также при помощи команды «Запусти художника» на умных устройствах Sber, в мобильном приложении Салют. Модель доступна на платформе ML Space в хабе предобученных моделей и датасетов DataHub.

Вам также могут понравиться