GPT Image 2.5: обзор и тесты новой нейросети OpenAI для генерации изображений

от автора

Подробный обзор GPT Image 2.5: генерация фото и рекламы, русский текст, инфографика, редактирование, Sketch, бенчмарки, API и результаты практических тестов.

OpenAI представила GPT Image 2.5 8 сентября 2026 года. Новая версия развивает GPT Image 2 — одну из самых сильных моделей для генерации изображений, особенно в фотореализме, работе с текстом и выполнении сложных промптов.

Основные изменения затронули не столько сам принцип генерации, сколько рабочий процесс. GPT Image 2.5 стала быстрее, точнее редактирует отдельные элементы, лучше сохраняет лица и предметы между правками и увереннее работает со сложной версткой и текстом.

В API появились две версии модели: GPT-Image-2.5 Flare для быстрых повседневных задач и GPT-Image-2.5 Sunburst для более точной генерации и редактирования. В ChatGPT новое поколение работает под общим названием ChatGPT Images 2.5.

🔗 Попробовать новый генератор изображений GPT Image 2.5


Что нового в GPT Image 2.5

Если GPT Image 2 уже хорошо справлялась с генерацией по тексту, то версия 2.5 заметно усиливает редактирование и последовательную работу с одним изображением.

Ключевые изменения:

  • Более высокая скорость генерации.

  • Улучшенный фотореализм и работа со светом.

  • Более точное выполнение длинных промптов.

  • Лучшее сохранение лиц, предметов и композиции.

  • Более стабильные последовательные правки.

  • Улучшенный текст внутри изображений.

  • Более точная инфографика и сложная верстка.

  • Новые инструменты Sketch, Templates и редактирование через комментарии.

Главный смысл обновления — уменьшить количество ситуаций, когда после небольшой правки приходится заново генерировать почти всю сцену.

Реализм и сложные промпты

GPT Image 2 уже хорошо понимала подробные описания сцен. Можно было задать одежду персонажа, освещение, объектив, фон, расположение объектов и текст на вывеске в одном запросе.

В версии 2.5 OpenAI заявляет дальнейшее улучшение instruction following — способности выполнять несколько условий одновременно. Это особенно полезно в рекламных изображениях, предметной съемке, редакционных иллюстрациях и сценах с большим количеством деталей. Мы же проверили это на практике.

Также улучшены:

  • Естественность освещения.

  • Текстуры кожи и материалов.

  • Распознаваемость лиц.

  • Сохранение деталей исходного изображения.

  • Работа с референсами.

Для фотореализма важна не только детализация. Даже очень резкое изображение выглядит искусственным, если неправильно построены отражения, тени, складки ткани или перспектива. GPT Image 2.5 как раз должна лучше справляться с такими мелкими несоответствиями.

Точечное редактирование

Это одно из самых заметных улучшений.

Раньше при простой просьбе изменить цвет кресла модель могла одновременно поменять освещение, декор или положение соседних предметов. В новой версии основной акцент сделан на локальных правках.

Например, можно попросить:

  • Заменить одежду человека.

  • Убрать объект с фотографии.

  • Изменить фон.

  • Перекрасить товар.

  • Исправить надпись.

  • Добавить новый предмет.

  • Изменить время суток или освещение.

При этом остальные детали должны сохраняться максимально близко к исходнику. 

Для коммерческой работы это важнее простого прироста качества генерации. Удачную картинку можно дорабатывать поэтапно, а не создавать заново после каждой ошибки.

Лучше сохраняются персонажи и объекты

У генераторов изображений давно есть проблема с consistency. После нескольких последовательных изменений лицо человека может постепенно меняться, даже если пользователь этого не просил.

GPT Image 2.5 должна лучше сохранять:

  • Черты лица.

  • Прическу.

  • Пропорции тела.

  • Форму предметов.

  • Расположение камеры.

  • Предыдущие внесенные изменения.

Например, можно сначала изменить фон, затем одежду, после этого добавить аксессуар и только потом поменять освещение. Чем меньше исходная сцена меняется между такими шагами, тем полезнее модель как рабочий редактор.

Текст и инфографика

Генерация текста остается одной из самых сложных задач для моделей изображений. GPT Image 2 уже была сильна в этой области, а 2.5 продолжила улучшение.

По свежему рейтингу Arena в категории Text Rendering GPT-Image-2.5 Sunburst получила 1481 ±23 балла, GPT-Image-2.5 Flare — 1434 ±22, а GPT Image 2 — 1427 ±7. Результаты новых моделей пока предварительные, поскольку они успели набрать меньше голосов.

Это полезно для:

  • Постеров.

  • Вывесок.

  • Меню.

  • Ценников.

  • Карточек товара.

  • Обложек.

  • Инфографики.

  • Рекламных баннеров.

OpenAI отдельно отмечает улучшение точности и компоновки инфографики. Модель должна лучше соблюдать порядок блоков, размещение элементов и структуру схем.

Для длинных абзацев текста генератор по-прежнему не заменяет обычную верстку, но короткие заголовки, цифры и подписи стали заметно надежнее.

Новые инструменты: Sketch, комментарии и шаблоны

Вместе с GPT Image 2.5 OpenAI обновила сам интерфейс работы с изображениями.

Sketch

Функция Sketch позволяет сначала набросать композицию, а затем превратить ее в полноценное изображение.

Например, пользователь рисует примерное расположение кровати, окна, стола и кресла, после чего просит создать реалистичный интерьер в нужном стиле.

Такой подход удобен, когда расположение объектов трудно подробно объяснить словами.

Sketch подойдет для:

  • Интерьеров.

  • Рекламных макетов.

  • Постеров.

  • Предметной съемки.

  • Сцен с несколькими объектами или персонажами.

Функция вызывается через @Sketch в поддерживаемых интерфейсах ChatGPT.

Комментарии к изображению

Еще один новый сценарий — редактирование через комментарии.

Можно указать конкретную часть изображения и написать:

Убрать этот предмет.

или:

Сделать эту стену светлее.

Это проще, чем подробно описывать местоположение объекта текстом, особенно в сложной сцене.

Templates

В Images также появились шаблоны для популярных типов графики. Они помогают начать не с пустого промпта, а с готовой визуальной структуры.

OpenAI приводит среди примеров постеры, merchandise и другие распространенные форматы.

Для опытного пользователя шаблоны не обязательны, но новичкам они заметно упрощают старт.

Протестировать все возможности GPT Image 2.5 самостоятельно

Как GPT Image 2.5 справилась с тестами

Я проверил GPT Image 2.5 на девяти сценариях: от фотореализма и текста до многошагового редактирования, Sketch и прозрачного фона. Задача была не получить самую красивую картинку, а посмотреть, насколько точно модель выполняет сложные условия и сохраняет результат при последующих правках.

Тест 1. Фотореализм в сложной сцене

Промпт описывал девушку, выходящую из книжного магазина после дождя, с движением, отражениями в лужах, трамваем, прохожими и сложным вечерним светом.

Проверял:

  • Естественность человека и позы.

  • Руки, ноги и движение.

  • Свет, тени и отражения.

  • Количество деталей в фоне.

  • Общее ощущение реальной фотографии.

Результат получился очень сильным. Свет выглядит естественно, теплые участки хорошо сочетаются с холодным небом, а мокрый асфальт и отражения не выглядят декоративной имитацией. В кадре много объектов, но сцена остается цельной и читаемой.

Сама фотография воспринимается как профессиональный уличный снимок. Поза естественная, одежда и волосы нормально реагируют на движение, явных проблем с руками или ногами я не заметил.

Тест 2. Сохранение персонажа при последовательных правках

Это был самый показательный тест. Я создал один портрет женщины в кафе, а затем последовательно менял фон за окном, одежду, добавлял часы и заменял напиток.

Проверял:

  • Сохранение лица.

  • Волосы, веснушки и черты внешности.

  • Положение головы и рук.

  • Стабильность композиции.

  • Накопление ошибок после нескольких редактирований.

Во всех версиях центральный персонаж практически не изменился. Сохранились форма глаз, лицо, прическа, веснушки, поза и положение рук. Модель меняла именно тот элемент, который был указан в запросе.

Для multi-turn editing это очень сильный результат. У старых генераторов уже после нескольких правок персонаж нередко начинал заметно «плыть».

Тест 3. Точечное редактирование интерьера

Во втором тесте на editing я использовал интерьер и последовательно менял цвет кресла, вазу на столе и картину на стене.

Проверял:

  • Локальность изменений.

  • Сохранение мебели и геометрии комнаты.

  • Стабильность освещения.

  • Изменения соседних объектов.

  • Насколько точно выполняется команда «не менять ничего другого».

Все три правки получились точечными. Диван, стол, окно, планировка и основная композиция сохранились. На этапе с вазой я заметил лишь небольшое изменение освещения, но оно не повлияло на структуру сцены.

Именно такие задачи хорошо показывают прогресс новой версии: ради одного небольшого изменения уже не приходится жертвовать половиной исходного изображения.

Тест 4. Русский текст и типографика

Для проверки текста я использовал полноценный рекламный постер с заголовком, тремя позициями меню, ценами, временем работы и адресом.

Проверял:

  • Кириллицу.

  • Цены и знак ₽.

  • Порядок строк.

  • Отсутствие лишнего текста.

  • Типографическую иерархию.

Результат получился почти безупречным. Русский текст написан правильно, цены и адрес переданы без ошибок, а сам макет выглядит аккуратно и профессионально.

В этом тесте GPT Image 2.5 показала, что текст на изображении уже можно воспринимать не как экспериментальную функцию, а как рабочий инструмент для постеров, меню, карточек и обложек.

Тест 5. Инфографика

Следующий запрос требовал создать схему сбора дождевой воды с пятью строго заданными этапами и правильным порядком.

Проверял:

  • Все ли этапы присутствуют.

  • Логику последовательности.

  • Направление стрелок.

  • Русский текст.

  • Соответствие визуала описанному процессу.

Модель хорошо справилась с информационной частью. Все пять этапов есть, последовательность легко читается, подписи аккуратные, а общая структура выглядит как готовая редакционная инфографика.

При этом результат нельзя воспринимать как инженерный чертеж. Например, расположение трубы выхода воды из резервуара стоило бы задавать точнее. Для технически корректной схемы нужен более жесткий и специализированный промпт.

Тест 6. Предметная реклама

Здесь задача была сложнее обычной товарной карточки: прозрачная бутылка, жидкость, лед, конденсат, металлическая крышка, всплеск воды и точный текст на этикетке.

Проверял:

  • Стекло и преломления.

  • Жидкость и пузырьки.

  • Конденсат и лед.

  • Текст на этикетке.

  • Качество коммерческой композиции.

Предмет получился отлично. Стекло выглядит объемным, капли и жидкость реалистичны, лед и всплеск воды хорошо вписаны в сцену. Этикетка читается, а сам кадр воспринимается как готовая рекламная съемка.

Это один из тех результатов, где модель не просто красиво рисует объект, а действительно собирает полноценную коммерческую композицию.

Тест 7. Sketch

Я загрузил простой рисунок спальни с заданным расположением окна, кровати, кресла, стола, растения и светильника, а затем попросил превратить его в фотореалистичный интерьер.

Проверял:

  • Сохранение планировки.

  • Положение ключевых объектов.

  • Количество предметов.

  • Соотношение размеров.

  • Насколько сильно модель интерпретирует эскиз.

Основную композицию GPT Image 2.5 считала правильно. Кровать, кресло, растение, стол и светильник остались на своих местах. Главное отличие — окно получилось чуть больше, чем на исходном рисунке.

В остальном Sketch действительно работает как инструмент управления композицией, а не как декоративная функция.

Тест 8. Сложный концепт-арт

В художественном тесте я попросил создать гигантский город внутри высохшего океанского кратера с многоуровневой инфраструктурой, центральной башней, водой, двумя лунами и маленькими человеческими фигурами для масштаба.

Проверял:

  • Чувство масштаба.

  • Передний, средний и дальний планы.

  • Архитектурную связность.

  • Количество деталей.

  • Соблюдение сложного описания.

Результат получился очень сильным. Масштаб считывается сразу, сцена хорошо разделена по глубине, архитектура выглядит цельной и достаточно правдоподобной даже при огромном количестве деталей.

Модель не ушла в хаотичный sci-fi и сохранила ощущение инженерно возможного города.

Тест 9. Прозрачный фон

В последнем тесте я попросил создать солнцезащитные очки на полностью прозрачном фоне с тонкой металлической оправой и полупрозрачными линзами.

Проверял:

  • Реальную прозрачность фона.

  • Чистоту контуров.

  • Полупрозрачность линз.

  • Отсутствие ореола.

  • Корректность мелких деталей оправы.

Результат получился очень чистым. Контуры аккуратные, обе дужки сохранены, линзы действительно полупрозрачные, заметного светлого ореола вокруг объекта нет.

Такое изображение уже можно использовать в карточке товара, презентации или рекламном макете.

Итоги тестирования

По итогам девяти тестов сильнее всего GPT Image 2.5 показала себя в редактировании. Серия последовательных правок практически не изменила персонажа, а в интерьерном тесте модель точно меняла только нужные объекты.

Фотореализм, предметная съемка и русский текст тоже получились очень сильными. Из заметных ограничений — небольшое изменение освещения после локальной правки и визуально убедительная, но не полностью инженерно корректная инфографика.

Главный прогресс 2.5 я вижу не только в качестве отдельных изображений, а в том, что их стало гораздо удобнее дорабатывать в несколько шагов без заметной деградации исходной сцены.

Flare и Sunburst: две версии GPT Image 2.5

В API OpenAI разделила модель на два варианта.

Параметр

GPT-Image-2.5 Flare

GPT-Image-2.5 Sunburst

Основная задача

Быстрая генерация

Максимальная точность

Скорость

Выше

Ниже

Генерация

Да

Да

Редактирование

Да

Да

Лучше подходит

Контент, соцсети, прототипы

Реклама, product photography, сложные правки

Flare позиционируется как основная модель для большинства задач. Она быстрее и подходит для регулярной генерации большого количества изображений.

Sunburst рассчитана на более сложную работу, где важнее точность, чем скорость: рекламу, предметную съемку, редактирование и готовые коммерческие материалы.

В обычном ChatGPT пользователю не требуется выбирать одну из этих двух API-моделей вручную.

GPT Image 2.5 против GPT Image 2

GPT Image 2 остается очень сильным генератором, поэтому разница между поколениями лучше всего заметна не в простой генерации «красивой картинки», а в более сложной работе.

Возможность

GPT Image 2

GPT Image 2.5

Генерация по тексту

Очень хорошо

Улучшена

Фотореализм

Очень высокий

Улучшен

Сложные промпты

Очень хорошо

Точнее

Текст на изображении

Один из лучших результатов

Улучшен

Локальное редактирование

Хорошо

Существенно усилено

Сохранение деталей

Хорошо

Стабильнее

Последовательные правки

Есть

Улучшены

Sketch

Нет

Есть

Скорость

Высокая

До 50% ниже latency у Flare

OpenAI заявляет, что Flare обеспечивает более высокое качество при задержке до 50% ниже, чем у GPT Image 2.

Для простой генерации разница между версиями может оказаться умеренной. Но если изображение приходится несколько раз исправлять, преимущества 2.5 становятся намного заметнее.

Что можно создавать

GPT Image 2.5 подходит как для фотографий, так и для графики.

Основные сценарии:

  • Фотореалистичные портреты и lifestyle-фотографии.

  • Предметная и рекламная съемка.

  • Интерьеры и архитектура.

  • Карточки товара.

  • Обложки и баннеры.

  • Постеры и афиши.

  • Инфографика и простые схемы.

  • Концепт-арт и фэнтези.

  • Детские иллюстрации.

  • Редактирование готовых фотографий.

Модель понимает русский язык, поэтому промпты необязательно писать на английском.

Для изображений с кириллицей лучше точно указывать нужный текст и отдельно просить не добавлять лишние надписи.

Бенчмарки GPT Image 2.5

Новая версия только появилась, поэтому большая часть независимых рейтингов еще собирает статистику.

В общем рейтинге Text-to-Image Arena GPT-Image-2.5 Sunburst на старте получила около 1421 ±13 баллов и вышла на первое место среди лабораторий. Результат пока отмечен как Preliminary.

Особенно сильный результат модель показала в Text Rendering:

Модель

Результат Arena

GPT-Image-2.5 Sunburst

1481 ±23

GPT-Image-2.5 Flare

1434 ±22

GPT Image 2

1427 ±7

MAI Image 2.6

1369 ±11

Grok Imagine Image 2.0

1352 ±20

Nano Banana 2

1292 ±7

Нужно учитывать размер выборки: GPT Image 2 успела получить значительно больше пользовательских оценок, поэтому позиции новых моделей еще могут измениться.

Сам факт сильного старта, однако, важен. GPT Image 2 до выхода новой версии уже занимала высокие позиции в Arena, в том числе по портретам. 2.5 не догоняет конкурентов с нуля, а развивает уже сильную базу.

API и стоимость

Для Flare и Sunburst доступны уровни качества:

  • Low.

  • Medium.

  • High.

  • Xhigh.

  • Max.

  • Auto.

Это позволяет выбирать между скоростью и качеством результата.

Базовые ставки API одинаковы для обеих моделей:

Тип

Цена за 1 млн токенов

Текст на входе

$5

Кэшированный текст

$1,25

Изображение на входе

$8

Кэшированное изображение

$2

Изображение на выходе

$30

OpenAI предупреждает, что старый калькулятор GPT Image 2 нельзя использовать для точного расчета стоимости 2.5. Ставка за токен совпадает, но фактический расход может отличаться.

Как пользоваться GPT Image 2.5 в России

В поддерживаемых странах проще всего открыть ChatGPT, описать нужную картинку и при необходимости продолжить ее редактирование в том же диалоге.

В России официальный доступ остается сложнее. OpenAI не включает РФ в список поддерживаемых стран, а использование сервисов компании из неподдерживаемого региона может привести к ограничениям аккаунта.

В последнее время появились и дополнительные проблемы с доступом со стороны российских сетей и провайдеров. Поэтому часть пользователей работает через агрегаторы нейросетей, которые подключают зарубежные модели через собственный интерфейс и принимают российские способы оплаты.

Как писать промпты

GPT Image хорошо понимает обычный язык, поэтому специальный синтаксис не требуется.

Удобный порядок описания:

Главный объект → окружение → композиция → освещение → стиль → ограничения.

Несколько простых правил обычно повышают точность результата:

  • Явно перечислять обязательные объекты.

  • Указывать точный текст в кавычках.

  • Описывать расположение важных элементов.

  • Отдельно писать, что нельзя менять при редактировании.

  • Не смешивать взаимоисключающие стили.

Если изображение уже почти подходит, чаще выгоднее исправить конкретную деталь, чем полностью запускать генерацию заново.

Промпты для GPT Image 2.5 из тестирования

Ниже — промпты, которые использовались в практических тестах GPT Image 2.5. Я специально подбирал задачи так, чтобы проверять не только визуальное качество, но и точность выполнения инструкций, работу с текстом, редактирование и сохранение деталей между правками.

Промпт для фотореалистичной фотографии

  • Для чего: Создание реалистичной динамичной сцены с человеком, сложным светом, движением и насыщенным фоном.

  • Что проверяет: Анатомию, естественность позы, отражения, физику света, перспективу и следование длинному промпту.

Промт

Фотореалистичная непостановочная уличная фотография молодой женщины 24 лет, которая быстро выходит из старого европейского книжного магазина в момент, когда на улице только что закончился сильный летний дождь. Она держит в одной руке несколько книг без пакета, второй рукой придерживает длинный темно-зеленый плащ, который подхватывает порыв ветра. Она не смотрит в камеру и находится в естественном движении, одна нога уже на мокром тротуаре, вторая еще на каменной ступени.

На заднем плане узкая историческая улица с небольшими кафе, велосипедом у стены, несколькими прохожими под закрывающимися зонтами и старым трамваем вдалеке. В больших лужах должны физически корректно отражаться женщина, фасады, вывески и яркое небо.

После дождя сквозь разрыв между темно-синими грозовыми облаками пробивается низкий теплый солнечный свет. Теплые золотые участки света смешиваются с холодными сине-серыми тенями.

Съемка на уровне глаз, 35 mm documentary photography, естественная перспектива, легкий motion blur на движущемся крае плаща и ноге, но лицо и книги резкие. Реалистичная кожа, естественные волосы, корректная анатомия обеих рук и ног, правильные пальцы, никаких постановочных модельных поз. Полная фигура в кадре, обе кисти и обе стопы видны полностью. Формат 16:9.

Промпт для предметной рекламы

  • Для чего: Генерация коммерческого изображения товара со стеклом, жидкостью, льдом, конденсатом и текстом на упаковке.

  • Что проверяет: Реалистичность материалов, физику отражений и преломлений, точность этикетки и качество рекламной композиции.

Промт

Профессиональная рекламная фотография премиального газированного напитка в прозрачной стеклянной бутылке сложной овальной формы.

В центре кадра стоит одна бутылка из толстого прозрачного стекла, внутри светло-рубиновая жидкость с мелкими пузырьками газа. Бутылка покрыта естественными каплями конденсата. Металлическая крышка матовая, серебристая, без деформаций.

На бутылке находится одна минималистичная кремовая этикетка. На ней должно быть написано строго:

NORTH BLOOM
RHUBARB & JUNIPER
SPARKLING BOTANICAL
330 ML

Не добавлять никаких других слов, букв, цифр или логотипов.

Бутылка стоит на массивной прозрачной ледяной плите. Внутри льда видны замороженные тонкие ломтики ревеня и ягоды можжевельника. Справа лежит один свежий стебель ревеня, слева — три ягоды можжевельника.

Позади бутылки находится тонкий полупрозрачный всплеск воды, но он не закрывает этикетку.

Свет студийный: холодный контровой свет подчеркивает края стекла и пузырьки, спереди мягкий нейтральный свет. Реалистичная оптика стекла, правильные преломления, корректная толщина стенок бутылки, физически правдоподобный лед, конденсат и тени.

Премиальная журнальная реклама, без декоративных элементов, без второго товара, без лишнего текста. Формат 4:5.

Промпт для изображения с русским текстом

  • Для чего: Создание рекламного постера с кириллицей, ценами, адресом и несколькими уровнями типографики.

  • Что проверяет: Точность русского текста, цифр и символов, порядок строк, читаемость и соблюдение заданной верстки.

Промт

Создай вертикальный рекламный постер для современной городской пекарни. Стиль — современный европейский editorial design, светлый кремовый фон, крупная типографика, реалистичная фотография выпечки, без винтажных клише.

В верхней части крупный заголовок:

ОСЕННЕЕ МЕНЮ

Ниже три позиции, строго в таком порядке:

БРИОШЬ С ИНЖИРОМ — 290 ₽
КРУАССАН С ФИСТАШКОЙ — 340 ₽
ТАРТ С ГРУШЕЙ — 390 ₽

В нижней части:

Каждый день с 8:00 до 21:00
Литейный проспект, 24

Использовать только этот текст. Не добавлять логотип, сайт, QR-код, телефон, английские слова или любые дополнительные надписи.

На постере должна быть одна реалистичная композиция из круассана, половинки инжира и груши на светлой каменной поверхности. Текст не должен перекрывать еду. Хорошая визуальная иерархия, ровная сетка, аккуратные интервалы, читаемая кириллица, правильный знак ₽, никаких ошибок в цифрах.

Формат 4:5.

Промпт для инфографики

  • Для чего: Создание понятной редакционной схемы с несколькими последовательными этапами и логическими связями.

  • Что проверяет: Структуру, порядок блоков, направление стрелок, точность подписей и способность модели не добавлять лишние элементы.

Промт

Создай светлую русскоязычную редакционную инфографику «Как работает система сбора дождевой воды в частном доме».

Нужно показать ровно пять последовательных этапов слева направо:

  1. ДОЖДЬ
    Вода попадает на крышу.

  2. ВОДОСТОК
    Поток собирается в желобах и трубах.

  3. ФИЛЬТР
    Листья и крупный мусор отсеиваются.

  4. НАКОПИТЕЛЬ
    Очищенная вода поступает в подземный резервуар.

  5. ПОВТОРНОЕ ИСПОЛЬЗОВАНИЕ
    Вода используется для полива сада и хозяйственных задач.

Нарисовать один дом в разрезе и показать путь воды стрелками от крыши до резервуара и затем к садовому крану.

Стрелки должны идти строго в правильном направлении. Каждый этап должен быть показан один раз. Не добавлять шестой этап, дополнительные резервуары, солнечные панели, канализацию или питьевую воду.

Стиль — современная журнальная инфографика, белый фон, четкие пиктограммы, минимум декоративных элементов, крупный читаемый русский текст, реалистичная логика системы, формат 16:9.

Промпты для сохранения персонажа при редактировании

  • Для чего: Последовательное изменение фона, одежды и отдельных предметов в одной и той же сцене.

  • Что проверяет: Сохранение лица, волос, позы, пропорций и других деталей персонажа после нескольких правок.

Промт

Исходный промпт

Фотореалистичная фотография молодой женщины 26 лет с короткими темно-каштановыми волосами, серо-зелеными глазами, небольшой родинкой под левым глазом и выраженными естественными веснушками на носу. На ней темно-синий костюм свободного кроя и белая футболка.

Она сидит за небольшим столиком у окна в современном кафе. Перед ней закрытый блокнот и чашка эспрессо. За окном пасмурный городской день. Мягкий естественный свет, съемка на 50 mm, нейтральная цветопередача, фотореализм, без модельной позы. Полупортрет по пояс, обе руки видны. Формат 4:5.

Правка 1

Измени только фон за окном: вместо пасмурного города сделай ночной Токио с дождем и мягкими неоновыми отражениями на мокром стекле. Женщину, ее лицо, волосы, одежду, руки, позу, стол, блокнот, чашку, освещение внутри кафе и кадрирование не менять.

Правка 2

Теперь замени только темно-синий костюм на светло-бежевый льняной жакет. Не меняй футболку, лицо, волосы, фигуру, руки, позу, фон, стол, предметы и освещение.

Правка 3

Добавь на левое запястье тонкие механические часы с темным кожаным ремешком. Не изменяй ничего другого.

Правка 4

Замени чашку эспрессо на прозрачный стеклянный стакан с холодным матча-латте и кубиками льда. Положение рук, блокнот, стол и все остальные элементы оставить неизменными.

Правка 5

Сделай так, чтобы женщина слегка улыбалась закрытым ртом. Это единственное изменение. Не менять форму глаз, нос, губы, родинку, веснушки, волосы, одежду, позу, руки, фон или композицию.

Промпты для точечного редактирования

  • Для чего: Изменение отдельных объектов в интерьере без перерисовки всей сцены.

  • Что проверяет: Локальность edit, сохранение геометрии, освещения, соседних объектов и общей композиции.

Промт

Исходный промпт

Фотореалистичная фотография современной гостиной в квартире архитектора. В центре низкий светло-серый модульный диван. Справа ярко-желтое кресло необычной округлой формы. Слева тонкий металлический торшер. Перед диваном овальный стол из темного дерева, на нем стеклянная ваза с одной веткой эвкалипта и две книги. На задней стене висит крупная абстрактная картина в черной раме. За диваном панорамное окно с видом на город утром.

Пол из светлого дуба, стены теплого белого оттенка. Естественный мягкий утренний свет. Архитектурная интерьерная фотография, 24 mm, прямые вертикальные линии, реалистичные материалы, без людей. Формат 16:9.

Редактирование 1

Измени только ярко-желтое кресло справа: сделай его темно-бордовым, сохранив точную форму, размеры, положение, материал и освещение. Не меняй ничего другого.

Редактирование 2

Удали только стеклянную вазу и ветку эвкалипта со стола. Две книги должны остаться на прежнем месте. Не изменяй стол, кресло, диван, картину, свет, окно и композицию.

Редактирование 3

Замени только абстрактную картину на черно-белую архитектурную фотографию в той же раме и того же размера. Все остальные элементы должны остаться без изменений.

Промпт для Sketch

  • Для чего: Превращение простого эскиза в фотореалистичный интерьер с заданным расположением объектов.

  • Что проверяет: Насколько точно GPT Image 2.5 считывает композицию, положение предметов, масштаб и пространственные отношения.

Промт

Преврати этот эскиз в фотореалистичную спальню в современном японском стиле. Сохрани расположение всех объектов, заданное рисунком.

Слева должно остаться большое окно во всю высоту стены. Справа — низкая кровать на деревянном подиуме. В центре — маленький круглый стол из темного дерева. В левом нижнем углу — одно кресло. Возле окна — одно высокое растение. Над столом — один минималистичный подвесной светильник.

Используй натуральное дерево, лен, штукатурку и теплый рассеянный утренний свет. Минимализм, никаких дополнительных кресел, столов, картин, полок или декоративных объектов. Архитектурная фотография, широкоугольный объектив, реалистичная перспектива. Формат 16:9.

Промпт для сложного концепт-арта

  • Для чего: Генерация большой фантастической сцены с архитектурой, инфраструктурой и выраженным масштабом.

  • Что проверяет: Композицию, глубину, атмосферную перспективу, связность большого количества деталей и выполнение сложных ограничений.

Промт

Панорамный реалистичный концепт-арт гигантского города, построенного внутри высохшего океанского кратера на другой планете.

В центре кратера находится колоссальная вертикальная башня, вокруг которой по спирали поднимаются жилые районы и сады. Стены старого кратера достигают нескольких километров высоты и покрыты террасами, мостами, промышленными лифтами и водосборными системами.

Через город проходит искусственная река, которая начинается у огромной установки для конденсации атмосферной влаги и заканчивается в небольшом внутреннем озере.

На ближайшей смотровой платформе стоят три очень маленькие человеческие фигуры, чтобы подчеркнуть масштаб.

Вдали над краем кратера видны две луны разного размера. Низкое боковое солнце освещает только верхние уровни города, нижние районы остаются в холодной голубой тени.

Очень четкое разделение переднего, среднего и дальнего плана, реалистичная атмосферная перспектива, правдоподобная архитектура, материалы и инфраструктура. Город должен выглядеть инженерно возможным, а не как абстрактная фантазия. Никаких летающих автомобилей, магии, огромных статуй или декоративных космических кораблей.

Cinematic realistic concept art, extremely detailed, 21:9.

Промпт для изображения на прозрачном фоне

  • Для чего: Создание отдельного предмета, пригодного для карточки товара, презентации или дальнейшего дизайна.

  • Что проверяет: Реальную прозрачность фона, чистоту краев, полупрозрачные материалы и отсутствие светлого ореола.

Промт

Создай один реалистичный предмет на полностью прозрачном фоне: премиальные солнцезащитные очки с тонкой титановой оправой и полупрозрачными дымчатыми линзами.

Очки показаны под углом 3/4, обе дужки полностью видны. На линзах есть мягкие естественные отражения студийного света, но за объектом не должно быть белого, серого, шахматного или цветного фона.

Края оправы, линз и дужек должны быть чистыми и точными, без светлого ореола. Полупрозрачность линз должна сохраняться. Один объект, без тени-плашки, без текста, без логотипа.

GPT Image 2.5 и конкуренты

В 2026 году рынок генераторов изображений уже достаточно плотный. Seedream силен в фотореализме и коммерческой графике, Nano Banana — в редактировании и работе с референсами, Grok Imagine — в быстрых творческих генерациях.

Сильная сторона GPT Image — универсальность. В одном интерфейсе модель может создать изображение по сложному описанию, добавить текст, принять референс, изменить отдельную часть и продолжить работу над той же сценой.

Поэтому сравнивать модели только по одному красивому портрету уже недостаточно. Для реальной работы важнее, сколько попыток требуется, чтобы получить нужный результат.

Ограничения

GPT Image 2.5 стала точнее, но сложные ошибки полностью не исчезли.

Проверять особенно внимательно стоит:

  • Мелкие анатомические детали.

  • Очень длинные надписи.

  • Большое количество персонажей.

  • Сложные технические схемы.

  • Точную геометрию.

  • Фирменную упаковку и мелкие элементы товара.

  • Длинные цепочки последовательных правок.

В коммерческих материалах результат все равно требует ручной проверки.

Безопасность и маркировка

OpenAI проверяет не только текстовый запрос, но и загружаемые изображения, инструкции на редактирование и готовый результат.

Для подтверждения происхождения AI-контента используются C2PA metadata и невидимая маркировка.

Ограничения особенно касаются опасного контента и злоупотребления изображениями реальных людей.


GPT Image 2.5 выглядит не как полностью новый генератор, а как серьезно доработанная версия уже сильной GPT Image 2.

Наиболее важные изменения:

  • Более точное редактирование.

  • Лучшее сохранение лиц и объектов.

  • Стабильные последовательные правки.

  • Улучшенный текст и инфографика.

  • Более высокая скорость.

  • Sketch и другие новые инструменты управления изображением.

Если GPT Image 2 уже хорошо подходила для создания фотографий, рекламы и графики, версия 2.5 делает тот же процесс удобнее, предсказуемее и быстрее. Именно это, а не только прирост визуального качества, выглядит главным преимуществом обновления.

Реклама. ООО «ДИДЖИТАЛ ГЕНИУС». ИНН 7813681158

ссылка на оригинал статьи https://habr.com/ru/articles/1080396/