OpenAI выпустила обновлённый генератор изображений ChatGPT Images 2.5. Главное обещание новой версии — более бережное отношение к исходным фотографиям: люди, предметы и места на отредактированных картинках должны оставаться узнаваемыми.

Иллюстрация к тесту генератора изображений ChatGPT Images 2.5 на фото реального человека

Почему ChatGPT не редактирует, а перерисовывает

Многие пользователи не догадываются, что происходит, когда они загружают снимок в ChatGPT и просят что-то в нём поменять. Нейросеть не правит пиксели, как это делает Photoshop, а использует фотографию примерно так же, как текстовый запрос: изображение превращается во внутреннее представление модели, после чего она заново генерирует картинку целиком.

В результате получается по сути новое изображение, которое лишь вдохновлено оригиналом. Отсюда характерные огрехи: слегка изменившиеся черты лица, «поплывшие» надписи, лишние или сросшиеся пальцы, другая фактура ткани. В 2025 году из-за этой особенности в неловкую ситуацию попало полицейское управление в американском штате Мэн — пропущенный через ChatGPT снимок оказался уже не исходной фотографией.

реклама кормит Уточку 🦆

Для развлечения такие отличия некритичны, но для документальных снимков, семейных фото и любой работы с реальными людьми они становятся серьёзной проблемой. Именно её OpenAI и попыталась решить в Images 2.5.

Что обещает OpenAI

В компании подчёркивают, что ценность изображений во многом определяется их связью с реальностью:

«Самые значимые изображения ощущаются укоренёнными в реальных людях, местах и воспоминаниях, на которых они основаны. Images 2.5 лучше работает с референсными фотографиями, перенося знакомые объекты в новые обстановки, визуальные стили и композиции. Герои снимков выглядят узнаваемее, освещение и текстуры — естественнее, а характерные черты с большей вероятностью сохраняются».

Пример работы Images 2.5 с референсной фотографией от OpenAIПример, опубликованный OpenAI

реклама кормит Уточку 🦆

Задача не новая: сохранение внешности персонажа между кадрами стало одним из главных направлений гонки генеративных моделей. Этим, в частности, прославилась модель Google Gemini 2.5 Flash Image, известная как Nano Banana, так что обновление ChatGPT выглядит в том числе ответом конкурентам.

Проверка на реальном человеке

OpenAI сопроводила анонс набором собственных примеров, но показательнее всего независимая проверка. Для теста использовали снимки обозревателя фототехники Джордана Дрейка.

Первая фотография — Дрейк в толстовке и джинсах стоит между двумя рыцарскими доспехами у старинного камина. Логичным запросом было превратить его самого в рыцаря. С латами и мечом модель справилась, но вот с лицом — нет: сгенерированный рыцарь почти не похож на реального человека.

Мужчина в синей толстовке и джинсах между двумя рыцарскими доспехами у каменного каминаИсходный снимок: мужчина в синей толстовке и джинсах стоит между двумя рыцарскими доспехами у каменного камина

Сгенерированный ChatGPT мужчина в полированных латах с мечом между двумя доспехами у каминаВерсия ChatGPT: мужчина в полных полированных латах держит меч, по бокам — два пустых доспеха на стойках у камина

реклама кормит Уточку 🦆

Вторая попытка — а больше двух правок бесплатный аккаунт ChatGPT сделать не позволил — оказалась заметно удачнее. На снимке Дрейк сидит на деревянной скамье в восьмиугольной комнате с камерой в руках.

Мужчина с эспаньолкой в тёмно-синей толстовке сидит на скамье с камерой на коленяхМужчина с эспаньолкой в тёмно-синей толстовке сидит на деревянной скамье в деревенской восьмиугольной комнате, держа камеру на коленях

Мужчина в тёмно-синей толстовке на деревянной скамье держит двухобъективную камеруМужчина с эспаньолкой в тёмно-синей толстовке сидит на деревянной скамье в деревенской восьмиугольной комнате и держит двухобъективную камеру

Без типичных артефактов не обошлось: надпись Rolleiflex на двухобъективной камере превратилась в невнятный набор букв, ремни стали полупрозрачными, а пальцы словно проходят внутрь корпуса. Зато сходство с реальным Джорданом Дрейком получилось почти пугающе точным.

Сравнение настоящей фотографии Джордана Дрейка и его версии от ChatGPT Images 2.5Кто же здесь настоящий Джордан Дрейк?

реклама кормит Уточку 🦆

Другие нововведения и доступность

Помимо более точной работы с референсами, в Images 2.5 появились и другие улучшения:

  • модель умеет превращать наброски и каракули в полноценные изображения;
  • генерация стала на 50% быстрее;
  • по словам OpenAI, картинки получают «более естественное освещение и богатые текстуры»;
  • модель лучше выполняет инструкции по редактированию «на протяжении нескольких шагов» диалога.

Images 2.5 уже доступна пользователям ChatGPT в десктопном и мобильном приложениях, а также в веб-версии. Кроме того, новая модель работает в Codex и ChatGPT Work.

Первые тесты показывают, что прогресс реален, но результат пока нестабилен: одна и та же модель может выдать как неузнаваемого рыцаря, так и почти неотличимый от оригинала портрет. Поэтому к «отредактированным» в ChatGPT снимкам по-прежнему стоит относиться как к новым изображениям, а не к правке исходной фотографии.