OpenAI представила GPT Image 2: значительное обновление модели генерации изображений

OpenAI выпустила новую модель GPT Image 2, доступную всем пользователям. Она обеспечивает высокую точность при работе с текстом, иконографией и сложными композициями в разрешении до 2K.

Источник
OpenAI представила GPT Image 2: значительное обновление модели генерации изображений
Фото: Calcalist / נוצר באמצעות AI

Компания OpenAI представила новую модель генерации изображений — GPT Image 2. Инструмент уже доступен всем пользователям, включая тех, кто использует бесплатную версию, при этом подписчикам платных тарифов доступны расширенные возможности. По заявлению разработчиков, новая модель обеспечивает беспрецедентный уровень специфичности и точности. Она способна следовать сложным инструкциям, сохранять детали и обрабатывать элементы, которые ранее вызывали затруднения: мелкий текст, иконографию, элементы пользовательского интерфейса и плотные композиции в разрешении до 2K.

Данный релиз стал ответом на выпуск моделей Nano Banana Pro и Nano Banana 2 от Google, которые ранее превосходили GPT Images 1.5 в работе с текстом. «Калькалист» провел сравнительный анализ новых моделей.

Создание изображений с текстом

Ключевым преимуществом GPT Image 2 стала способность корректно генерировать текст, включая иврит, в различных стилях. Модель успешно имитирует рукописный текст и создает детализированные скриншоты. Однако при попытке смены конкретного шрифта модель уступила Nano Banana, обладающей доступом к предустановленному набору шрифтов. При создании инфографики на основе файлов Word и Excel модель показала смешанные результаты, однако при прямой передаче данных из таблиц качество визуализации оказалось впечатляющим.

Качество изображения

GPT Image 2 демонстрирует более высокую четкость и реализм по сравнению с предыдущей версией. В сравнении с Nano Banana Pro однозначного лидера выделить сложно: выбор зависит от личных предпочтений пользователя, так как реализм Nano Banana остается на высоком уровне. Имитация лиц знаменитостей также была улучшена, хотя идеальной точности модель пока не достигает.

Редактирование деталей

GPT Image 2 значительно превзошла свою предшественницу в редактировании отдельных элементов. Модель способна удалять текст с изображения, не затрагивая остальные детали, что недоступно для Nano Banana. При изменении мелких визуальных атрибутов, таких как аксессуары, модель вносит минимальные правки, сохраняя общую композицию. Кроме того, OpenAI реализовала возможность изменения размеров изображения, сравнявшись по этому параметру с инструментами Google.

Читайте также