Новости Grok научился менять картинки почти без следов правки

NewsMaker

I'm just a script
Премиум
28,949
46
8 Ноя 2022
Grok дорисовывает пространство за пределами исходника, удаляет фон и меняет отдельные объекты без полной перерисовки сцены.

<div class="articl-text-cover" style="position:relative;width:100%;max-width:800px;margin-left:auto;margin-right:auto;aspect-ratio:1400/788;margin-bottom:2rem;overflow:hidden">
7z24grrkriuodxysrrcxmx69ignkpaix.jpg

<div itemprop="articleBody">Grok получил новую модель генерации изображений Imagine Image 2.0, которую xAI явно пытается превратить из игрушки для красивых картинок в полноценный рабочий инструмент. Модель умеет точечно редактировать готовые изображения, сохранять детали между правками, работать сразу с несколькими референсами и заметно лучше справляется с текстом внутри картинки. Imagine Image 2.0 уже доступна в режиме Quality на сайте Grok и в мобильных приложениях для iOS и Android.

При разработке xAI сделала упор на точное выполнение сложных промтов. По заявлению компании, модель заранее продумывает композицию и расположение текста примерно так же, как дизайнер собирает макет. Благодаря такому подходу Imagine Image 2.0 должна лучше справляться с инфографикой, плакатами, страницами с несколькими визуальными блоками и другими изображениями, где генераторам обычно трудно одновременно сохранить структуру, детали и читаемые надписи.

Особое внимание разработчики уделили редактированию. Инструмент Magic Wand позволяет указать конкретную область и изменить только выбранный фрагмент, не перерисовывая остальную сцену. Сегментация помогает точнее выделять объекты, а отдельная функция удаления фона сохраняет выбранный предмет или человека на прозрачном фоне. Imagine Image 2.0 также принимает до пяти исходных изображений за одну генерацию, поэтому модель может объединять несколько визуальных референсов без ручного монтажа в графическом редакторе.

Ещё одна функция получила название Smart Resize. Пользователь выбирает новое соотношение сторон, после чего Grok не просто растягивает или обрезает исходник, а дорисовывает недостающие части кадра. Один и тот же материал можно таким способом превратить, например, из квадратной картинки в вертикальный постер, широкоформатный баннер или изображение 16:9.

xAI также обещает лучше сохранять персонажей, предметы и общий стиль между последовательными генерациями. Возможность особенно полезна при создании серий иллюстраций, игровых ассетов и видеопроектов. Компания показывает пример мира, где персонаж, локации и предметы создаются отдельно, но сохраняют общий визуальный язык.

Вместе с моделью появились готовые шаблоны для типовых задач. Среди них редактирование фотографий, изменение цвета товара, создание рекламных постеров, коллажей, профессиональных портретов, иконок, игровых персонажей, эмодзи и изображений для интернет-магазинов. Пользователю достаточно выбрать сценарий и загрузить исходные материалы вместо составления сложного промта с нуля.

По данным xAI, Imagine Image 2.0 на 7 августа заняла второе место одновременно в рейтингах Arena для генерации изображений по текстовому описанию и редактирования картинок. Результаты Arena формируются на основе сравнительных оценок пользователей, поэтому позицию нельзя считать абсолютным измерением качества, но рейтинг позволяет сравнивать модели на одинаковых пользовательских тестах. Сторонние публикации также указывают, что новая модель xAI расположилась сразу за GPT-Image-2 от OpenAI.

Пока Imagine Image 2.0 ориентирована на обычных пользователей Grok. Разработчики обещают открыть доступ через API позднее, но точную дату xAI пока не назвала.
 
Источник новости
www.securitylab.ru

Похожие темы