GPT Image 2 возглавляет все три крупнейшие арены со слепым голосованием: на Artificial Analysis её рейтинг составляет 1 340 Elo — на 78 пунктов выше, чем у GPT Image 1.5. Однако одно изображение в высоком качестве может стоить до $0.21, тогда как у gpt-image-1-mini цена опускается ниже $0.01. Выбор зависит от задачи: для рекламных материалов, массового прототипирования и редактирования товарных фотографий нужны разные модели. Ниже разбираем актуальную линейку OpenAI по качеству, цене, разрешению и возможностям редактирования.
В рамках этой статьи рассматриваются только собственные модели OpenAI для генерации изображений: GPT Image 2, GPT Image 1.5, gpt-image-1-mini и устаревшая GPT-4o. Сравнение с Midjourney, FLUX и Stable Diffusion — в нашем сравнении AI-генераторов изображений за 2026 год.
Какие модели для изображений сейчас есть у OpenAI
Через API OpenAI доступны четыре модели генерации изображений, описанные в её гайде по промптам. Каждая рассчитана на свой баланс качества и стоимости.
GPT Image 2 вышла 21 апреля 2026 года и стала флагманской моделью OpenAI. Согласно гайду компании, это «самая сильная модель в целом»: у неё есть встроенный этап рассуждений, гибкий выбор разрешения вплоть до экспериментальных ~4K и поддержка любых соотношений сторон в пределах ограничений по числу пикселей. OpenAI рекомендует её «как вариант по умолчанию для большинства production-процессов».
GPT Image 1.5 появилась в декабре 2025 года. Этапа рассуждений у неё нет, зато есть параметр input_fidelity со значениями low/high: он определяет, насколько подробно модель сохраняет детали исходного изображения при редактировании. Разрешения ограничены фиксированными вариантами: 1024×1024, 1024×1536, 1536×1024 или auto. В гайде OpenAI советует оставлять её «только для обратной совместимости на время проверки миграции промптов».
gpt-image-1-mini — бюджетная модель, оптимизированная, по документации OpenAI, под «стоимость и пропускную способность». Она подходит для пакетной генерации вариантов, быстрого поиска идей, превью и черновых материалов, где максимальное качество не требуется.
Генерация изображений GPT-4o — исходные ChatGPT Images — по-прежнему работает в пользовательском приложении. Но API-модель за ней, GPT Image 1, OpenAI относит к категории «только для совместимости с устаревшими решениями» и прямо рекомендует перейти на GPT Image 2.
Качество и следование промпту: разрыв по Elo
Арены со слепым голосованием — наиболее близкий к объективному способ оценить качество: люди выбирают лучший результат, не зная, какая модель его создала.
По состоянию на август 2026 года GPT Image 2 занимает первое место во всех трёх основных рейтингах:
| Арена | GPT Image 2 | GPT Image 1.5 | Разрыв |
|---|---|---|---|
| Artificial Analysis (13 289 голосов) | 1 340 Elo | 1 262 Elo | 78 пунктов |
| arena.ai (LMArena) | 610–631 Elo | Не ранжируется отдельно | — |
| llm-stats.com (13 552 голоса) | 661 Arena score | 333 Arena score | 328 пунктов |
Преимущество в 78 пунктов на Artificial Analysis — самый большой разрыв между первым и вторым местом за всю историю этого рейтинга.
Работа с текстом — главное преимущество новой модели. GPT Image 2 достаточно точно воспроизводит многоязычные надписи, включая латиницу и CJK, поэтому Artificial Analysis оценивает результат как «почти идеальный». Для логотипов, инфографики и любых изображений с текстом это выбор по умолчанию. GPT Image 1.5 неплохо справляется с простыми макетами, но в плотных композициях с несколькими шрифтами может терять символы.
«GPT-Image-2 вышла, и модель безумно хороша в отрисовке текста и мельчайших деталей в сложных интерфейсах ПО» — u/Glittering-Neck-2505, r/singularity
Фотореализм тоже стал лучше, хотя без компромиссов не обошлось. Пользователи Reddit отмечают, что GPT Image 2 производит сильное первое впечатление реализмом, но иногда создаёт «повторяющиеся паттерны и текстуры» в природных объектах. Один из пользователей сравнил фактуру скал с «процедурно сгенерированными текстурами из видеоигры». У GPT Image 1.5 этого конкретного артефакта нет, но общий уровень детализации ниже.
Вот мой тест GPT Image 2: ночная сцена в токийском кафе с неоновой вывеской «COFFEE», чтобы проверить отрисовку текста под нагрузкой (gpt-image-2, высокое качество, 16:9):
Неоновая надпись с первой попытки получилась правильной, а капли дождя прорисованы по отдельности, а не превращены в равномерное размытие.
Сколько стоит изображение в каждой GPT-модели
OpenAI тарифицирует модели для изображений не за картинку, а за токены. Ниже приведены ставки из страницы цен OpenAI, проверенные в августе 2026 года, а также ориентировочная стоимость одного изображения.
Тарифы за токены (за 1 млн токенов)
| Модель | Текстовый ввод | Ввод изображения | Кэшированный ввод изображения | Вывод изображения |
|---|---|---|---|---|
| gpt-image-2 | $5.00 | $8.00 | $2.00 | $30.00 |
| gpt-image-1.5 | $5.00 | $8.00 | $2.00 | $32.00 |
| gpt-image-1-mini | $2.00 | $2.50 | $0.25 | $8.00 |
Ориентировочная цена изображения в зависимости от качества
Расчёты предполагают генерацию text-to-image в разрешении 1024×1024 по промпту длиной 50–100 слов. Фактическая стоимость зависит от разрешения и сложности промпта.
| Качество | gpt-image-2 | gpt-image-1.5 | gpt-image-1-mini |
|---|---|---|---|
| Низкое | ~$0.006 | ~$0.009 | ~$0.003 |
| Среднее | ~$0.03–0.07 | ~$0.04–0.08 | ~$0.01 |
| Высокое | ~$0.10–0.21 | ~$0.10–0.20 | ~$0.03–0.05 |
Значения «низкое», «среднее» и «высокое» соответствуют параметру quality в API-запросе, например quality="low". От настройки зависит токен-бюджет, который модель выделяет на прорисовку деталей: при низком качестве генерируется меньше выходных токенов, а значит, снижается цена.
Есть и неочевидный нюанс: выходные токены GPT Image 1.5 стоят $32/1M, тогда как у GPT Image 2 — $30/1M. Поэтому для быстрого прототипирования в низком качестве GPT Image 2 дешевле: $0.006 за изображение против $0.009 у GPT Image 1.5.
gpt-image-1-mini обходится примерно в три раза дешевле. В задачах с большим объёмом — например, при создании 10 000 превью товарных вариантов — разница между $0.003 и $0.006 даёт экономию $30 на пакет.
Разрешение и возможности редактирования
GPT Image 2 принимает через параметр size любое разрешение, если соблюдены ограничения из документации OpenAI:
- Максимальная сторона < 3 840px
- Обе стороны кратны 16
- Соотношение сторон ≤ 3:1
- Общее число пикселей — от 655 360 до 8 294 400
Популярные форматы: 1024×1024 для квадратных изображений, 2560×1440 как надёжный 2K-вариант и 3824×2144 для экспериментального режима, близкого к 4K. OpenAI отмечает, что результаты выше 2K «более вариативны».
GPT Image 1.5 ограничена четырьмя фиксированными размерами: 1024×1024, 1024×1536, 1536×1024 или auto. Произвольные разрешения не поддерживаются.
В редактировании лидирует GPT Image 2: на арене Artificial Analysis она набирает 1 255 Elo и опережает Google's Nano Banana Pro с 1 247. Параметр input_fidelity в GPT Image 1.5 даёт явный контроль над сохранением исходного изображения при правках. GPT Image 2 этот параметр не поддерживает, поскольку, по словам OpenAI, «вывод уже по умолчанию имеет высокую точность воспроизведения».
| Возможность | gpt-image-2 | gpt-image-1.5 | gpt-image-1-mini |
|---|---|---|---|
| Максимальное разрешение | ~4K (экспериментально) | 1536×1024 (фиксированное) | 1536×1024 (фиксированное) |
| Произвольные соотношения сторон | Да | Нет (4 пресета + auto) | Нет (4 пресета + auto) |
| Этап рассуждений | Да | Нет | Нет |
| input_fidelity | Отключён (всегда высокий) | Low / High | Low / High |
| Elo на арене редактирования | 1 255 (#1) | Не ранжируется отдельно | Не ранжируется |
Какую GPT-модель выбрать под свою задачу
Маркетинг и рекламные креативы
Берите GPT Image 2 в среднем или высоком качестве. Этап рассуждений точнее передаёт компоновку и текст, когда промпт составлен как креативный бриф. В своём гайде OpenAI советует писать для этой модели промпты «как креативный бриф, а не как сугубо техническую спецификацию изображения».
Мокапы товаров и e-commerce
GPT Image 2 — для главных изображений, gpt-image-1-mini — для превью вариантов. Основное фото товара генерируйте в GPT Image 2 с высоким качеством: гибкое разрешение позволяет точно попасть в размеры витрины. Для цветовых вариаций, ракурсов и фонов используйте gpt-image-1-mini по $0.003 за изображение. Линейка из 50 SKU с 5 вариантами каждого обойдётся примерно в $0.75 при низком качестве mini.
Инфографика и изображения с большим количеством текста
GPT Image 2. По данным Artificial Analysis, модель почти идеально воспроизводит текст на латинице и в CJK-письменностях. GPT Image 1.5 справляется с простыми надписями, но пропускает символы в плотных макетах с несколькими шрифтами. Выбирайте среднее или высокое качество: на низком читаемость текста падает у всех моделей.
Массовая пакетная генерация
gpt-image-1-mini в низком качестве. При цене $0.003 за изображение 100 000 картинок обойдутся в $300. GPT Image 2 на низком качестве за $0.006 тоже разумна, если качество важнее пропускной способности. У GPT Image 1.5 здесь нет ценового преимущества: её выходные токены стоят на $2/1M дороже, чем у GPT Image 2.
Итеративное редактирование
GPT Image 2 — для большинства правок, GPT Image 1.5 — если нужен контроль input_fidelity. GPT Image 2 лидирует на арене редактирования, но переключатель fidelity в GPT Image 1.5 позволяет выбрать между режимами «сохранить всё» и «свободно переосмыслить». Если этот контроль критичен для вашего процесса, у GPT Image 1.5 есть структурное преимущество.
FAQ
GPT Image 2 всегда лучше GPT Image 1.5?
Не для любого процесса. GPT Image 1.5 предлагает контроль input_fidelity при редактировании, а в природных сценах — скалах, листве и шерсти — её результаты лишены артефактов с повторяющимися текстурами, о которых сообщают пользователи GPT Image 2. Когда нужно жёстко сохранить исходное изображение, GPT Image 1.5 может оказаться лучше. Но по работе с текстом, следованию промпту и фотореализму выигрывает GPT Image 2.
Стоит ли по-прежнему использовать GPT-4o для генерации изображений?
Нет, если только вам не нужен пользовательский интерфейс ChatGPT без доступа к API. OpenAI классифицирует GPT Image 1, стоящую за GPT-4o, как модель «только для совместимости с устаревшими решениями» и рекомендует перейти на GPT Image 2.
Можно ли пользоваться GPT Image 2 бесплатно?
Ограниченная генерация изображений доступна в бесплатном тарифе ChatGPT и в плане Go за $8 в месяц. Для API новые аккаунты OpenAI получают $5 бесплатных кредитов — этого хватает примерно на 25–800 изображений в зависимости от выбранного качества.
Для чего подходит gpt-image-1-mini?
Для задач с большим объёмом и жёстким бюджетом: быстрого поиска идей, вариантов для A/B-тестов, временных ассетов, превью миниатюр и пакетной персонализации. При низком качестве и цене около $0.003 за изображение она примерно в 10 раз дешевле GPT Image 2 на среднем качестве. Не выбирайте её для изображений с большим объёмом текста или клиентских материалов, где хорошее качество с первого прохода сокращает число циклов согласования.