21 апреля 2026, 15:53
OpenAI релизнула GPT Image 2. Что изменилось и когда ждать программный оболочку

21 апреля 2026 года OpenAI запустила фазовый роллаут GPT Image 2 - следующей версии нативной модели генерации изображений, встроенной в экосистему Chat GPT. Пока доступ ограничен подписчиками Plus, Team и Enterprise. Фришка и разработчики ждут до начала мая.
Итак, краткая хронология самого продукта:
Март 2025 - GPT Image 1 выходит вместе с GPT-4o. Первая нативная мультимодальная генерация, не DALL-E.
Декабрь 2025 - апдейт до GPT Image 1.5. И, скажем так – это был ощутимый прирост по фотореализму и скорости. Ну и как сейчас – без отдельно анонса.
Апрель 2026, начало месяца - на Arena появляются анонимные модели с codename maskingtape, gaffertape, packingtape. Комьюнити вычисляет новую генерацию за некоторое количество недель до объявления.
21 апреля 2026 – ура, официальный старт роллаута GPT Image 2.
Заявленные технические изменения
Типовой вывод - до 4096×4096 пикселей.
Примерно вдвое быстрее GPT Image 1.5 при сопоставимых параметрах запроса.
Заявленная точность на типографических бенчмарках - 99%. И это главное маркетинговое направление. GPT Image 1.5 держался на ~95%, что уже было лучшим результатом в классе. Хотя, естественно, проверить 99% независимо пока затруднительно - публичного бенчмарка с воспроизводимой методологией нет.
В релизе акцентируют новые классификаторы и водяные знаки следующего поколения, встроенные непосредственно в схема. OpenAI использует стандарт C2PA - защищённые метаданные с цифровой подписью, которые верифицируются через Content Credentials.
Значимый нюанс. C2PA-метаданные стираются при скриншоте, пережатии или репосте в большинство соцсетей. Невидимые пиксельные паттерны устойчивее, но не абсолютны.
Кому доступно сейчас
Категория | Статус |
ChatGPT Plus / Team / Enterprise | Роллаут начался 21 апреля |
ChatGPT Free | Не заявлено, дата не называется |
программный интерфейс (Images api / Responses api) | Запланировано на начало мая 2026 |
До выхода api на прод девелоперские интеграции остаются на GPT Image 1.5.
GPT Image 1.5 на момент выхода держала верхние строчки в Artificial Analysis Image Arena и Arena.ai по adherence к промпту и рендеру текста.
Ну и по нашему скромному мнению. Конкуренты - Midjourney v7-8.1 (лидирует по артистике), FLUX.2 Pro (скорость и api-масштабирование), Gemini 3.1 Flash Image (фотореализм). GPT Image 2 претендует минимум на удержание лидерства в text-in-image задачах.
Что сейчас неизвестно
Ценовая модель api пока не раскрыта.
Архитектурные детали (diff с Image 1.5) не опубликованы.
Точные параметры watermarking-алгоритма не описаны.
Независимые бенчмарки появятся не раньше старта api-доступа.
Несколько простых примеров генерации
Запрос: Нарисуй карту Беларуси


Запрос: Сделай анатомическую схему человеческой головы


В третьем варианте мы использовали референс и детальный промпт


Как и во все предыдущие релизы – схема раскатывается постепенно. Проверяем изменения на chatgpt.com и тестируем новую схема.
Читают сейчас

3 часа назад
Forbes: цифровой оператор «Сбербанк‑Телеком» протестировал работу в режиме мультисети
Оператор связи «Сбербанк‑Телеком» стал обладателем технологии мультисети, пишет Forbes со ссылкой на собеседника, близкого к компании. По его словам, уже прошло тестирование работы в этом режиме. Пред

4 часа назад
Учёные: современная жизнь толкает человеческий разум к пределам возможностей
В новой статье, опубликованной в журнале Behavioral Sciences, социологи из сингапурских научных учреждений проанализировали предыдущие исследования и теории, чтобы сформулировать следующий вывод: стре

4 часа назад
ЕС выписал AliExpress рекордный штраф в размере €550 млн за торговлю нелегальными товарами на платформе
Европейская комиссия выписала китайскому маркетплейсу AliExpress штраф в размере €550 млн за неспособность предотвратить продажу на платформе нелегальные товары, включая вредную одежду, косметику и ку

4 часа назад
Исследование: Claude Code отправляет в 4,7 раза больше служебных токенов, чем OpenCode
Организация Systima сравнила объём служебных данных, которые Claude Code и OpenCode передают языковой модели наряду с пользовательским запросом. Решение от Anthropic использует в 4,7 раза больше токен

5 часов назад
Ответ на Kimi K3: зачем Alibaba выкатила 2,4-триллионную Qwen3.8
На конференции WAIC в Шанхае Alibaba представила Qwen3.8 — новую мультимодальную модель на 2,4 трлн параметров. По заявлению компании, архитектура уступает по производительности только Claude Fable 5,