Если вы когда-либо пытались редактировать изображение, сгенерированное ИИ, вы знаете, насколько утомителен текущий рабочий процесс. Вы видите, что именно нужно изменить, но объяснение этого чат-боту часто напоминает нудную игру в «испорченный телефон». Обычно приходится обводить область, выходить из редактора, а затем вводить длинный запрос в основном чате, чтобы исправить всего одну деталь. Что ж, недавние утечки предполагают, что Google готовится раз и навсегда исправить неудобный процесс редактирования изображений с помощью ИИ в Gemini.
Точное редактирование изображений с помощью ИИ: утечка о предстоящих инструментах разметки Google Gemini
Последние находки были опубликованы изданием Android Authority. Согласно отчету, в новом обновлении бета-версии приложения Google (версия 17.10.54.sa.arm64) представлен гораздо более мощный интерфейс для редактирования изображений. Это обновление специально разработано для контента, созданного с помощью моделей семейства Nano Banana.
Самое значительное изменение — это добавление динамического текстового поля непосредственно в окне разметки. Ранее Gemini предлагал только базовые инструменты, такие как карандаш или маркер. Это заставляло вас покидать окно редактирования, чтобы описать желаемые изменения. В предстоящей версии вы сможете оставаться на месте, обводить конкретный объект и немедленно вводить инструкции в поле внизу экрана. Это сделает настройку с помощью ИИ намного точнее.
Помимо текстового поля, утечка также указывает на два новых экспериментальных инструмента под названием Resize (Изменение размера) и Effects (Эффекты). Функция Resize, вероятно, позволит переключаться между форматами «Квадрат», «Портрет» и «Альбом» без необходимости генерировать совершенно новое изображение с нуля.
Эти улучшения пользовательского интерфейса соответствуют более широкому развертыванию Nano Banana 2 наряду с моделью Gemini 3.1 Flash Image. Google разработала этот движок как для скорости, так и для точности, обеспечивая лучшее отображение текста и более глубокое понимание реальных объектов. Google использует мощь своего ИИ, чтобы сократить разрыв между базовым ИИ-артом и управляемым редактированием профессионального уровня.
В настоящее время эти функции скрыты в бета-коде и требуют ручной активации. Кроме того, некоторые из них пока не работают. Тем не менее, их наличие указывает на скорый публичный запуск.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Jean Leon




