IskraGen

GPT Image 2: что умеет модель и чем отличается от первой

Модели и цены27 августа 20269 мин чтения
Парящий снимок в светящейся рамке: фиолетовый луч пересобирает его правую половину в вечернюю сцену, слева висит схема композиции из тонких линий
Сгенерировано в IskraGen · gpt-image-2-text-to-image
Промпт

Сцена: тёмное студийное пространство, глубокий почти чёрный фон #0A0A0F, боковая фиолетовая подсветка #7C3AFF, лёгкая объёмная дымка, мягкое зерно. Главный объект: парящая в центре кадра фотография в тонкой светящейся рамке — обычный дневной снимок улицы; сквозь неё слева направо проходит широкий фиолетовый луч, и правая половина того же снимка на глазах пересобирается: дневное небо становится вечерним, фонари загораются, фон меняется, а фигура и геометрия сцены остаются прежними. Слева от фотографии в воздухе висит полупрозрачная сетка-схема композиции из тонких линий и точек — план кадра, который строится до отрисовки. Детали: матовое стекло рамки, фиолетовые частицы вдоль луча, тонкие направляющие линии сетки, мягкие отражения на гладком тёмном полу, разница температуры света между левой и правой половинами снимка. Композиция: 16:9, фотография чуть правее центра, сетка-схема в левой трети, широкое негативное пространство сверху, ракурс на уровне глаз, контрастный мягкий свет, неглубокая глубина резкости. Ограничения: absolutely NO text, NO letters, NO numbers, NO logos, NO brand marks, NO watermarks; никаких эмблем OpenAI, ChatGPT и других сервисов; узнаваемых лиц крупным планом не показывать. Назначение: обложка статьи блога о нейросети для генерации и редактирования изображений. Стиль: тёмный фон #0A0A0F, акцентный фиолетовый #7C3AFF, крупный рубленый шрифт, без водяных знаков.

Главное:

  • GPT Image 2 — модель OpenAI: вышла в апреле 2026 года и разбирает запрос до того, как начать рисовать.
  • Шаг вперёд против первой версии — надписи на картинке и точечные правки, не задевающие остальную сцену.
  • Режим image-to-image меняет ваше фото словами: до 16 референсов, каждый весом до 10 МБ.
  • Слабые места — скорость и потеря сходства лица при серии правок в одном диалоге.
  • В IskraGen обе стороны модели стоят от 5 ₽ за картинку, оплата российской картой.

Запрос «gpt image 2» набирают 9 445 раз в месяц, а более общий «gpt images» — почти 15 тысяч. За этими двумя цифрами стоят разные люди: одни ищут, как вообще рисовать картинки в ChatGPT, другие пришли за конкретной второй версией модели и хотят понять, что в ней поменялось. Дальше — ответы обеим группам: где проходит граница между чатом и моделью, что GPT Image 2 умеет лучше предшественницы, где она до сих пор промахивается и сколько стоит запуск из России в рублях.

GPT Image 2 и «картинки в ChatGPT» — это одно и то же?

GPT Image 2 — это сама модель, а картинки в ChatGPT — лишь один из способов её запустить. Ядро одно, оболочек несколько.

Разница похожа на разницу между двигателем и машиной. Модель — двигатель: она принимает текст и референсы, возвращает изображение. ChatGPT — привычный кузов вокруг него: чат, история переписки, кнопка загрузки файла. Тот же двигатель ставят и в другие кузова — в API для разработчиков и в сервисы-агрегаторы, где модель доступна отдельной карточкой без чата.

Отсюда путаница в запросах. «Chat gpt image» и «gpt images» — это про интерфейс: человек хочет картинку и не думает о версиях. «GPT Image 2» и «gpt image 2.0» — уже про конкретное поколение модели, с его характеристиками и ограничениями. Названия соседствуют, потому что OpenAI обновляет генератор внутри чата молча: интерфейс не меняется, а модель под ним становится новой.

Практический вывод простой. Если вам нужна пара картинок и вы уже платите за чат — открывайте ChatGPT и не думайте о версиях. Если картинок нужно много, важен предсказуемый формат кадра или требуется оплата российской картой — удобнее работать с моделью напрямую.

В каталоге IskraGen модель разложена на две карточки по типу входа. GPT Image 2 — Text to Image принимает только текстовое описание и стоит от 5 ₽ за изображение. GPT Image 2 — Image to Image принимает ещё и картинку-референс, чтобы переделать готовый кадр, и стоит столько же — от 5 ₽. Разделение удобное: вы сразу выбираете сценарий, а не ищете нужную кнопку внутри диалога.

Чем GPT Image 2 отличается от первой версии

GPT Image 2 вышла в апреле 2026 года и стала первой моделью OpenAI, которая рассуждает перед генерацией: сначала разбирает запрос, потом рисует.

Этот шаг «подумать до отрисовки» и объясняет остальные отличия. Модель сначала планирует композицию — что где стоит, какая надпись куда ложится, — и только затем отрисовывает кадр. Раньше картинка собиралась одним движением, и сложная сцена рассыпалась на противоречивые детали.

Три изменения заметны без тестов и бенчмарков.

  • Текст на картинке. В независимом обзоре надпись легла чётко, в правильном месте и в тон сцене — максимальная оценка 5 из 5 за рендер текста. По замерам другого теста точность нелатинских шрифтов держится около 95 %, а среди поддерживаемых письменностей — кириллица, хинди, японский и арабский. Модель даже выдаёт рабочие QR-коды.
  • Кириллица на длинных фразах. По сравнению с прошлым поколением новая версия стабильнее выводит длинные надписи и мелкий шрифт, и чистых результатов без опечаток становится больше. Для упаковки, обложек и постеров это решает главную боль генераторов.
  • Аккуратность правок. При точечном редактировании GPT Image 2 реже трогает то, что не просили: замена одного элемента оставляет остальную сцену практически нетронутой, а границы масок обрабатываются чище.

Технические рамки тоже расширились. У модели три уровня разрешения — 1K, 2K и 4K, причём в 4K длинная сторона доходит до 3840 пикселей. Пропорции доступны от 3:1 до 1:3: 1:1, 2:3, 3:2, 4:5, 5:4, 4:3, 3:4, 16:9, 9:16 и 21:9, при этом форматы 5:4 и 4:5 работают только на 1K. За один запрос модель отдаёт до восьми согласованных между собой изображений — удобно, когда нужна серия карточек с одним героем.

Есть и режим «Обдумывания», в котором разбор запроса идёт подробнее, а типографика заявлена на 48 языках. Практический смысл: чем сложнее сцена и чем больше в ней текста, тем заметнее выигрыш второй версии над первой.

Инфографика: шесть отличий GPT Image 2 от первой версии — план сцены до отрисовки, текст на картинке, кириллица, аккуратные правки, разрешения и серия из восьми кадров

Что изменилось во второй версии модели

Правки по своему фото словами: режим image-to-image

Image-to-image — это когда вы загружаете своё фото и описываете правку обычными словами, а модель возвращает изменённый кадр. Ради этого в GPT Image 2 и приходит большинство.

Сценарии почти всегда бытовые. Поменять фон на офисный для аватарки в резюме. Убрать лишнего человека из отпускного снимка. Переодеть героя, перекрасить стену, добавить в кадр предмет, которого там не было. Собрать из фото товара карточку для маркетплейса с подписью. Всё это делается текстом, без слоёв, масок и графического редактора.

Технические рамки режима щедрые: за один запрос модель принимает до 16 референс-изображений весом до 10 МБ каждое. Работает и одиночный референс, и слияние нескольких — например, лицо с одного снимка и одежда с другого. Отдельная механика Cross-Image Consistency удерживает внешность персонажа в серии кадров, чтобы герой не менялся от картинки к картинке.

Точность следования запросу при редактировании в независимом обзоре названа одной из лучших — выше, чем у редактирования изображений в Midjourney. Но у этой точности есть условие: правка должна быть сформулирована как «что сохранить и что изменить». Формулировка «сделай красиво» даёт случайный результат, формулировка «оставь лицо и позу, замени фон на вечернюю улицу» — предсказуемый.

Порядок работы, который экономит деньги и нервы:

  1. Загрузите оригинал в максимальном качестве — модель не додумает то, чего не видно на входе.
  2. Опишите одну правку за запуск и явно назовите то, что менять нельзя.
  3. Оцените результат и вернитесь к оригиналу, а не к предыдущей версии картинки.
  4. Повторите с уточнённой формулировкой, если что-то пошло не так.

В IskraGen этот режим — карточка GPT Image 2 — Image to Image, от 5 ₽ за правку. Загружаете снимок, пишете задачу по-русски, получаете результат без подписки. Про то, какие ещё задачи со снимком закрываются нейросетями, мы разбирали в статье нейросеть для фото.

Где GPT Image 2 до сих пор ошибается

Главная слабость GPT Image 2 — серия правок в одном диалоге: с каждым новым ходом лицо всё сильнее уходит от исходного референса.

У эффекта есть название — iterative drift. Вы просите поправить фон, потом свет, потом причёску, и к пятому шагу на картинке уже другой человек. Детали теряются постепенно, поэтому подмену замечают не сразу. Рабочее противоядие одно: возвращаться к оригиналу и накатывать одну правку заново с уточнённым описанием, а не строить цепочку из десяти уточнений.

Второе слабое место — скорость. В обзоре, где модель гоняли внутри ChatGPT, генерация занимала около 1,5–2 минут на изображение: заметно медленнее большинства инструментов. Прямые тесты модели дают 10–20 секунд на высоком качестве, и разница объясняется той самой ступенью рассуждения плюс очередями в интерфейсе. Итоговая оценка модели в том обзоре — 3,8 из 5, и снизили её именно за скорость и неудобное встроенное редактирование.

Третье — режим рассуждения с веб-поиском срабатывает не всегда: в тесте он просто не активировался, когда должен был. Полагаться на то, что модель сама подтянет актуальные данные для картинки, пока рано.

Есть и содержательные ограничения. Модель не берётся имитировать стиль конкретного живущего художника и не рисует откровенные или жестокие сцены. Запрос в этом духе вернётся отказом, и обойти его переформулировкой не выйдет.

Если задача упирается в одно из ограничений, в каталоге есть соседние модели того же класса: Nano Banana 2 Lite от 3 ₽ для быстрых черновиков, Qwen Image 3.0 — Текст в картинку от 5 ₽ и Seedream 5.0 Pro — Текст в картинку от 7 ₽, когда нужен другой характер картинки.

Промпты, которые дают предсказуемый результат

Надёжный промпт для GPT Image 2 состоит из четырёх частей: сцена, главный объект, детали и формат кадра. Порядок важнее красоты формулировок.

Отдельное правило действует для надписей. Текст в промпте берут в двойные кавычки и рядом объясняют контекст — где именно надпись расположена и на чём написана. Сравните: «постер с надписью распродажа» и «постер, на верхней трети крупная надпись "РАСПРОДАЖА", белые буквы на тёмно-синем фоне». Второй вариант даёт чистый результат заметно чаще.

Заготовка для генерации с нуля:

Сцена и свет. Главный объект и что он делает. Две-три детали переднего плана. Ракурс и пропорция кадра. Чего в кадре быть не должно.

Заготовка для правки готового фото:

Сохрани [что остаётся неизменным]. Замени [что меняем] на [чем меняем]. Не трогай [зоны, которые нельзя задевать].

Три привычки, которые снимают большую часть промахов:

  • Задавайте пропорцию явно, а не надейтесь на угадывание. Помните про рамку: 5:4 и 4:5 доступны только на 1K.
  • Пишите запреты отдельной строкой — «без текста», «без рамки», «без лишних рук в кадре».
  • Меняйте один параметр за итерацию: так видно, какая формулировка сработала.

Промпты на русском модель понимает, но описания сложных сцен точнее разбираются на английском — это общая черта генераторов изображений. Разбор формул с примерами мы собрали в материале про промт для фото нейросети.

Сколько стоит GPT Image 2 и как запустить её из России

Бесплатный вход в GPT Image 2 существует, но без гарантий: генерация картинок доступна на бесплатном плане ChatGPT, а фиксированный лимит OpenAI не публикует.

Единственный честный источник актуального числа — баннер внутри интерфейса: он зависит от нагрузки и состояния аккаунта. Цифры вида «2–3 генерации в сутки на бесплатном плане» и «40–50 за три часа на подписке», которые кочуют по статьям, — оценка сообщества на конкретный момент, а не официальный факт, и устаревают они каждые четыре-шесть недель. Поэтому запросы «gpt image бесплатно» и «gpt image 2 бесплатно» упираются в одно и то же: попробовать можно, планировать работу на этом нельзя.

Второй барьер для России — оплата. Подписка и официальный API требуют зарубежной карты, которая у большинства просто не проходит. Рабочий обход — российские сервисы-агрегаторы: они дают доступ к модели без привязки иностранной карты, а оплата идёт в рублях.

В IskraGen цена прозрачная и без абонентской платы:

  • GPT Image 2 — Text to Image — от 5 ₽ за изображение по текстовому описанию.
  • GPT Image 2 — Image to Image — от 5 ₽ за правку загруженного снимка.

Оплата разовая: вы пополняете баланс российской картой и тратите его по факту генераций. Десять картинок обойдутся примерно в полсотни рублей, и никакого месячного платежа за неиспользованные дни не будет. Интерфейс русскоязычный, VPN не нужен, регистрация — по почте.

Порядок запуска занимает пару минут: выбираете карточку модели под свой сценарий, пишете промпт или загружаете фото, задаёте пропорцию кадра, запускаете. Результат скачивается сразу, права на использование остаются за вами. Если параллельно нужны другие генераторы изображений, сравнение моделей и подход к выбору собраны в обзоре нейросеть для генерации изображений.

Инфографика: цена и доступ к GPT Image 2 из России — лимиты бесплатного плана не публикуются, две карточки модели по 5 ₽, оплата российской картой

Цена и доступ к модели из России

Частые вопросы

Попробовать GPT Image 2 — Text to Image в IskraGen

Генерация без VPN, оплата в рублях через СБП. Первые генерации — за минуту.

Похожие статьи