GPT Image 2.5: быстрее, точнее и с новыми инструментами в ChatGPT
OpenAI выпустила ChatGPT Images 2.5 и две модели в API: GPT-Image-2.5 Flare и GPT-Image-2.5 Sunburst. По словам компании, каждую неделю через ChatGPT Images и GPT-Image в API люди генерируют больше 3 млрд картинок, и этот релиз про то, чтобы делать это быстрее и с меньшим числом перегенераций.
Ниже: что реально изменилось, чем отличаются две модели, какие инструменты появились в ChatGPT и какие промпты OpenAI показывает как образцы.
Коротко: в чём суть релиза
Предыдущие версии GPT-Image хорошо рисовали с нуля, но плохо держали детали при правках. Images 2.5 явно заточена под другой сценарий:
Первая генерация почти никогда не финальная. Нужна точечная правка, а не перегенерация всего кадра.
Отсюда и набор изменений: точечное редактирование, сохранение субъекта по референсу, консистентность между ходами, плюс снижение латентности до 50% относительно Images 2.0.
Две модели в API: Flare и Sunburst
В API вышли две модели с разными приоритетами.
GPT-Image-2.5 Flare — маленькая модель, оптимизированная под скорость. Качество примерно на уровне GPT Image 2, но латентность ниже. Подходит для контента в соцсетях, прототипов, визуального поиска и массовой генерации. OpenAI называет её вариантом по умолчанию для большинства задач.
GPT-Image-2.5 Sunburst — базовая модель, оптимизированная под качество. Качество выше, чем у GPT Image 2, но генерация дольше. Заточена под премиальные креативные задачи: продакшен-кампании, товарные снимки, сложное редактирование.
Логика выбора простая. Если у вас уже есть рабочий процесс на GPT Image 2 и качество устраивает, начните с Flare и проверьте, можно ли удержать качество при меньшей латентности. Если GPT Image 2 не дотягивает на сложной задаче, начните с Sunburst и сначала добейтесь нужного качества. Если Sunburst справляется, проверьте Flare на тех же промптах и переключайтесь, если качество остаётся приемлемым.
Параметры API
Параметры задаются отдельно от промпта.
| Параметр | Значения |
|---|---|
model | gpt-image-2.5-flare или gpt-image-2.5-sunburst |
quality | auto (по умолчанию), low, medium, high, xhigh, max |
size | auto или своё разрешение. Частые: 1024x1024, 1536x1024, 1024x1536, 2048x2048, 2048x1152, 3840x2160, 2160x3840 |
background | auto, opaque, transparent |
Для своего разрешения формат WIDTHxHEIGHT с ограничениями: каждая сторона не больше 3840 px, обе стороны кратны 16, соотношение сторон не больше 3:1, общее число пикселей от 655 360 до 8 294 400. Разрешения больше 3 686 400 пикселей (примерно 2560x1440) считаются экспериментальными.
Модель выбирают до настройки quality. Одинаковая метка качества не означает одинаковую картинку и одинаковую скорость на разных моделях. Если результат не устраивает, поднимайте качество. Если устраивает, попробуйте ниже, чтобы сэкономить на латентности. xhigh и max используйте, только когда они реально закрывают конкретное требование.
Для прозрачных ассетов явно укажите background="transparent" и используйте PNG или WebP. Проверяйте альфа-канал на волосах, стекле, тенях и краях объектов. output_compression работает только для JPEG и WebP, не для PNG.
Что нового в генерации
Точнее работает с референсами. Модель лучше переносит знакомых людей и объекты в новые сцены и стили. Субъекты узнаются лучше, свет и текстуры естественнее, отличительные черты чаще сохраняются. Для API это значит, что вариации надёжнее держатся у оригинала.
Точечное редактирование. Images 2.5 лучше правит только то, что вы попросили, и оставляет остальное нетронутым, даже на сложных фонах. В API это даёт менять один элемент (товар, фон, текст), сохраняя субъект, композицию и брендовое оформление.
Консистентность между ходами. В длинных диалогах модель надёжнее следует инструкциям правки. Предыдущие изменения чаще остаются на месте, а новая правка наслаивается, не ухудшая качество. Для продакшена это значит, что можно вносить точечные правки без пересборки всего ассета.
Лучше понимает сложные инструкции. Картинки с реальной информацией точнее по содержанию, модель держит сложные лейауты и прозрачные фоны, лучше передаёт визуальные стили. Для бизнеса это значит, что сложные брифы меньше «уплывают» по мере уточнения деталей.
Новые инструменты в ChatGPT
Sketch. Можно нарисовать набросок прямо в ChatGPT и использовать его как визуальную опору. Эскиз комнаты, контур одежды или просто дудл, и модель превращает rough art в готовую картинку. Чтобы запустить, наберите @Sketch в ChatGPT.
Шаблоны. Для популярных форматов (плакат, мерч, товарное фото) есть готовые стартовые шаблоны. Не начинаете с пустого холста, а выбираете шаблон и добавляете свои детали: текст, элементы дизайна, стили.
Комментарии на изображениях. Можно оставлять комментарии прямо на картинке, чтобы редактировать прицельнее.
Обмен промптами. При шеринге картинки можно приложить промпт, который к ней привёл. Другой человек берёт ту же идею и подставляет свои фото и детали.
Образцы промптов от OpenAI
Ниже примеры из документации OpenAI. Каждый показывает отдельный приём. Слева GPT-Image-2.5 Flare, справа GPT-Image-2.5 Sunburst.
Фотореализм: свет и текстура
Опишите снимок через субъект, кадр, свет и текстуру. Здесь просят candid-композицию и явно исключают ретушь. Настройки: size="1024x1536", quality="medium".
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat.
He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms.
He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens.
Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance.
The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
Точный текст в рекламе
Текст берите в кавычки и говорите, сколько раз он должен появиться. Укажите аудиторию и визуальную обработку без лишних инструкций. Настройки: size="1024x1536", quality="medium".
Give me a cool in culture ad / fashion shot for a brand called Thread.
It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create."
Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful.
Use clean composition, strong color direction, natural poses, and premium fashion photography cues.
Render the tagline exactly once, clearly and legibly, integrated into the ad layout.
No extra text, no watermarks, no unrelated logos.
Логотип с прозрачным фоном
Опишите бренд и формы, которые задают знак. Просите чистую композицию, читаемую при разных размерах. Настройки: size="1024x1536", quality="medium", background="transparent", output_format="png".
Create an original, non-infringing logo for a company called Field & Flour, a local bakery.
The logo should feel warm, simple, and timeless. Use clean, vector-like shapes, a strong silhouette, and balanced negative space.
Favor simplicity over detail so it reads clearly at small and large sizes. Flat design, minimal strokes, no gradients unless essential.
Fully transparent background. Deliver a single centered logo with generous padding, clean alpha edges, and no solid backdrop, scenery, checkerboard, or watermark.
Сохранение идентичности при смене одежды
Передайте фото человека и несколько референсов одежды. Укажите, что у человека должно остаться неизменным, и разрешите менять только одежду. Настройки: size="1024x1536", quality="medium".
Edit the image to dress the woman using the provided clothing images. Do not change her face, facial features, skin tone, body shape, pose, or identity in any way. Preserve her exact likeness, expression, hairstyle, and proportions. Replace only the clothing, fitting the garments naturally to her existing pose and body geometry with realistic fabric behavior. Match lighting, shadows, and color temperature to the original photo so the outfit integrates photorealistically, without looking pasted on. Do not change the background, camera angle, framing, or image quality, and do not add accessories, text, logos, or watermarks.
Прозрачный вырез товара
Просите изолированный субъект и background="transparent" в API. Используйте PNG или WebP, сохраняйте альфа-канал, не передавайте output_compression для PNG. Настройки: size="1024x1536", quality="medium", background="transparent", output_format="png".
Extract the product from the input image and isolate it on a fully transparent background.
Output: centered product, crisp silhouette, no halos/fringing.
Preserve product geometry and label legibility exactly.
Add only light polishing. Do not add a solid backdrop, checkerboard, scenery, or shadow.
Do not restyle the product; remove the background and preserve clean alpha transparency.
Многопанельный комикс
Для стори-в-комикс задайте нарратив как последовательность чётких визуальных битов, по одному на панель. Держите описания конкретными и ориентированными на действие. Настройки: size="1024x1536", quality="medium".
Create a short vertical comic-style reel with 4 panels.
Panel 1: The owner leaves through the front door. The pet is framed in the window behind them, small against the glass, eyes wide, paws pressed high, the house suddenly quiet.
Panel 2: The door clicks shut. Silence breaks. The pet slowly turns toward the empty house, posture shifting, eyes sharp with possibility.
Panel 3: The house transformed. The pet sprawls across the couch like it owns the place, crumbs nearby, sunlight cutting across the room like a spotlight.
Panel 4: The door opens. The pet is seated perfectly by the entrance, alert and composed, as if nothing happened.
Многоходовое редактирование: билборд и смена погоды
Начните с одного результата, проверьте и используйте как следующий вход. Держите каждый следующий шаг узким, чтобы видеть, какая правка помогла.
Шаг 1. Билборд с шампунем на закате. Настройки: size="1024x1536", quality="medium".
Create a realistic billboard mockup of the shampoo on a highway scene during sunset.
Billboard text (EXACT, verbatim, no extra characters):
"Fresh and clean"
Typography: bold sans-serif, high contrast, centered, clean kerning.
Ensure text appears once and is perfectly legible.
No watermarks, no logos.
Шаг 2. Передаём результат первого шага как вход и меняем только погоду.
Make it look like a winter evening with snowfall.
Безопасность
Images 2.5 строится на существующих защитных механизмах OpenAI: проверка промптов и картинок, чтобы снизить риск вредного контента. Для идентификации сгенерированных изображений используется C2PA-метаданные и невидимый ватермарк. Подробности в системной карте модели.
Доступность и цены
Images 2.5 раскатывается для пользователей всех тарифных планов VEGA, по стоимости 8 звезд за 1 генерацию.
Выводды
GPT Image 2.5 - долгожданная новинка от OpenAI, на данный момент это самый совершенный генератор изображений.