Компания «Яндекс» официально представила свою новую разработку — единую нейросетевую модель Alice AI ART 2.0. Главной особенностью этой системы стало объединение двух ключевых функций: она способна как создавать изображения с нуля по текстовому описанию, так и редактировать уже готовые файлы согласно пользовательским инструкциям.

Представители «Яндекса» пояснили, что до текущего момента инструменты для генерации и редактирования контента развивались параллельно. Это были два независимых технологических стека с собственными базами данных, метриками и методами обучения. Любые доработки приходилось внедрять для каждой системы отдельно. Архитектурный переход к единой модели позволил интегрировать оба сценария в рамках одного процесса: теперь все знания, полученные ИИ при обучении генерации, мгновенно применяются и при редактировании.
Преимущества единой архитектуры
Особое внимание разработчики Alice AI ART 2.0 уделили работе с редкими визуальными концептами. Если нейросеть обучили распознавать и воспроизводить специфические детали, например, элементы хохломской росписи или образ самовара, то модель сможет корректно встраивать эти объекты в уже существующие изображения при редактировании.
Кроме того, в архитектуру был встроен специализированный модуль, отвечающий за расширение пользовательского запроса. Это решение позволило существенно улучшить качество интерпретации команд. По данным «Яндекса», внедрение такого модуля повысило точность редактирования изображений примерно на 12%, при этом параметры самой генеративной модели остались прежними.
На сегодняшний день возможности Alice AI ART 2.0 уже доступны пользователям в приложении «Алиса» и сервисе «Шедеврум». Владельцы устройств могут как создавать уникальные картинки по текстовым описаниям, так и вносить правки в свои изображения, используя простые инструкции.






