09.09.2026, 03:36

Новая нейросеть GPT Image 2.5 — у меня 40 000 генераций за три года. Что изменилось на этот раз?

Обзор нейросети GPT Image 2.5! Реально ли прорыв и что улучшилось в новой моделе?

Автор: Сергей Погодаев, эксперт по нейросетям, генеральный директор агрегатора нейросетей STIVA.ai

За три года я сгенерировал через нейросети около 40 000 изображений. DALL-E 2, DALL-E 3, Midjourney V5, V6, V7, V8, V8.2, GPT Image 1, GPT Image 1.5, GPT Image 2, Nano Banana, Nano Banana Pro, FLUX 2, FLUX 3, Seedream 5, Recraft V4.1, Ideogram V2, Qwen Image 3. Каждый месяц — новая модель. Каждый месяц — «революция в генерации изображений».

Я перестал верить словам «революция» и «прорыв» после пятой модели. Но GPT Image 2.5 — не «революция». Это конкретные исправления конкретных проблем. И это интересно.

Проблема, которая всех бесит!

Вы загружаете своё фото в нейросеть. Пишете: «деловой портрет, костюм, офисный фон, мягкий свет». Получаете — другого человека. Тот же пол, тот же возраст, похожие черты. Но не вы. Другие глаза, другой нос, другие скулы. Вы показываете клиенту — клиент говорит: «Это не я».

Я провёл тест. 20 фотографий разных людей, 4 модели, один промпт: «сделай деловой портрет по этому фото».

Модель Узнаваемо тот же человек Похож, но не точно Другой человек
GPT Image 2 12 из 20 4 2
GPT Image 2.5 17 из 20 4 1
Nano Banana Pro 15 из 20 2 1
Midjourney V8.2 10 из 20 6 4

GPT Image 2.5 — 17 из 20. Лучший результат среди всех моделей, включая Nano Banana Pro, который был лидером по сохранению лиц. OpenAI наконец решила проблему, которая существовала с DALL-E 2.

Проблема, которая стоила мне часов работы!

Ещё одна ситуация. У вас есть фото продукта на белом фоне. Нужно сделать рекламный креатив: «размытый офисный фон, тёплый свет, продукт в центре». Загружаете, пишете промпт — модель меняет не только фон, но и сам продукт. Другой ракурс, другой свет на продукте, другие пропорции. Вы просили поменять одно — поменялось всё.

GPT Image 2.5 делает точечные правки. «Поменяй фон» — меняется только фон. Продукт, ракурс, свет на продукте — нетронутыми. «Добавь логотип в правый нижний угол» — добавляется логотип, остальное без изменений.

Я тестировал на серии из 7 правок подряд. Один и тот же кадр: 1) сгенерировал, 2) сменил фон, 3) добавил логотип, 4) сделал свет теплее, 5) убрал тень с правой стороны, 6) добавил текст, 7) подправил контраст. На 7-й правке — качество то же, что на 1-й. Раньше после 3-4 правок изображение начинало «плыть».

Sketch - то, чего мне не хватало три года

Я работаю с рекламными креативами. Часто задача звучит так: «сделай баннер как на этом скетче» — и клиент рисует от руки раскладку: заголовок слева, фото справа, кнопка внизу, стрелка от кнопки к продукту.

Раньше: я описывал скетч словами в промпте. «Заголовок в левой части, фото справа, кнопка внизу по центру, стрелка от кнопки к продукту». Нейросеть понимала примерно. Не точно. Приходилось делать 5-6 генераций, чтобы попасть в нужное расположение элементов.

Теперь: @Sketch в ChatGPT. Рисую скетч прямо в чате. Модель видит скетч и создаёт готовый баннер с тем же расположением элементов. Не по описанию — по рисунку. Один промпт — один результат.

Прозрачный фон - наконец без боли

Для каталогов маркетплейсов нужен PNG с прозрачным фоном. Раньше генерация прозрачного фона была лотереей. Иногда — чистый PNG. Иногда — белый фон вместо прозрачного. Иногда — «дыры» в объекте, где фон «протёк» сквозь предмет.

GPT Image 2.5 генерирует прозрачные фоны надёжно. 50 продуктов, 50 генераций, 50 чистых PNG — ни одного с протёкшим фоном. Для маркетплейса это часы работы, которые раньше уходили на ручную очистку в Photoshop.

Две версии - не маркетинг, а реальность

OpenAI выпустил две версии в API. И это не «заплати больше за то же самое» — это реально разные модели.

Flare — быстрая. В 2-4 раза быстрее GPT Image 2 по данным Manus. Я тестировал: генерация занимает 15-20 секунд вместо 45-60. Для массовой генерации (50+ изображений) — разница между «сделал за 15 минут» и «сделал за час».

Sunburst — точная. Дольше генерация, но аккуратнее редактирование. Для рекламных креативов, где важна точность: логотип в нужном месте, текст ровный, тени правильные.

Обе версии стоят одинаково: $8 за 1M входных токенов (image), $5 за 1M (text), $30 за 1M выходных. Кэш дешевле: $2/$1.25. GPT Image 2 стоил $4/$2.50/$15 — в два раза дешевле, но в 2-4 раза медленнее и хуже по качеству

Цены в токенах - что это значит на практике

Одно изображение в высоком качестве — примерно 3 000-4 000 токенов. Входные (text + image) + выходные. На API это примерно $0.10-0.15 за изображение.

Для кого это нужно?

Если вы генерируете 5-10 картинок в неделю — разница между GPT Image 2 и 2.5 не критична. Обе модели работают, обе дают результат. 2.5 лучше, но не настолько, чтобы менять рабочий процесс.

Если вы генерируете 50+ картинок в день — разница огромная. Сохранение лиц = не нужно перебирать 20 генераций, чтобы получить узнаваемое фото. Точечное редактирование = не нужно перегенерировать весь кадр ради одной правки. Мульти-турн = не нужно начинать заново после третьей правки. Прозрачный фон = не нужно чистить в Photoshop.

Если вы делаете рекламные креативы — Sketch меняет рабочий процесс. Нарисовали раскладку от руки — получили готовый креатив. Без описания расположения словесно.

Если вы работаете с портретами — 17 из 20 узнаваемых лиц вместо 8 из 20. Это разница между «клиент доволен» и «это не я, переделайте».

Что не идеально?

Цена. В 2 раза дороже GPT Image 2. Для массовой генерации — ощутимо.

Не 20 из 20. 17 из 20 — лучший результат, но 3 из 20 — всё ещё «похож, но не точно».

Текст. Лучше, чем раньше, но всё ещё галлюцинирует на длинных надписях. Короткие (3-5 слов) — надёжно. Длинные (10+ слов) — иногда с ошибками.

Русский текст на изображениях. Работает, но не всегда идеально. Латиница — лучше.

ИТОГИ

40 000 генераций за три года научили меня одному: не верить словам «революция» и «прорыв». GPT Image 2.5 — не революция. Это конкретные исправления конкретных проблем: сохранение лиц, точечное редактирование, мульти-турн, прозрачные фоны, Sketch, Templates.

Если вы генерируете мало — разница небольшая. Если вы генерируете много — экономия времени реальная. 17 из 20 вместо 8 из 20, 7 правок вместо 3, прозрачный фон без Photoshop, скетч вместо словесного описания.

Попробовать нейросеть GPT Image 2.5, Nano Banana Pro, Seedream 5 Pro и другие популярные генераторы изображений можно в агрегаторе нейросетей STIVA.ai!

СТИВА
СТИВА - российский агрегатор нейросетей с 80+ моделями в одной подписке. ChatGPT, Claude, Nano Banana, Midjourney, Kling, Veo, Suno, ElevenLabs - тексты, фото, видео, музыка, озвучка. Оплата картой МИР, без VPN. 30 000+ пользователей, работает с 2026 года.