OpenAI выпустила обновлённый генератор изображений ChatGPT Images 2.5. Главное обещание новой версии — более бережное отношение к исходным фотографиям: люди, предметы и места на отредактированных картинках должны оставаться узнаваемыми.
Почему ChatGPT не редактирует, а перерисовывает
Многие пользователи не догадываются, что происходит, когда они загружают снимок в ChatGPT и просят что-то в нём поменять. Нейросеть не правит пиксели, как это делает Photoshop, а использует фотографию примерно так же, как текстовый запрос: изображение превращается во внутреннее представление модели, после чего она заново генерирует картинку целиком.
В результате получается по сути новое изображение, которое лишь вдохновлено оригиналом. Отсюда характерные огрехи: слегка изменившиеся черты лица, «поплывшие» надписи, лишние или сросшиеся пальцы, другая фактура ткани. В 2025 году из-за этой особенности в неловкую ситуацию попало полицейское управление в американском штате Мэн — пропущенный через ChatGPT снимок оказался уже не исходной фотографией.
Для развлечения такие отличия некритичны, но для документальных снимков, семейных фото и любой работы с реальными людьми они становятся серьёзной проблемой. Именно её OpenAI и попыталась решить в Images 2.5.
Что обещает OpenAI
В компании подчёркивают, что ценность изображений во многом определяется их связью с реальностью:
«Самые значимые изображения ощущаются укоренёнными в реальных людях, местах и воспоминаниях, на которых они основаны. Images 2.5 лучше работает с референсными фотографиями, перенося знакомые объекты в новые обстановки, визуальные стили и композиции. Герои снимков выглядят узнаваемее, освещение и текстуры — естественнее, а характерные черты с большей вероятностью сохраняются».
Задача не новая: сохранение внешности персонажа между кадрами стало одним из главных направлений гонки генеративных моделей. Этим, в частности, прославилась модель Google Gemini 2.5 Flash Image, известная как Nano Banana, так что обновление ChatGPT выглядит в том числе ответом конкурентам.
Проверка на реальном человеке
OpenAI сопроводила анонс набором собственных примеров, но показательнее всего независимая проверка. Для теста использовали снимки обозревателя фототехники Джордана Дрейка.
Первая фотография — Дрейк в толстовке и джинсах стоит между двумя рыцарскими доспехами у старинного камина. Логичным запросом было превратить его самого в рыцаря. С латами и мечом модель справилась, но вот с лицом — нет: сгенерированный рыцарь почти не похож на реального человека.
Исходный снимок: мужчина в синей толстовке и джинсах стоит между двумя рыцарскими доспехами у каменного камина
Версия ChatGPT: мужчина в полных полированных латах держит меч, по бокам — два пустых доспеха на стойках у камина
Вторая попытка — а больше двух правок бесплатный аккаунт ChatGPT сделать не позволил — оказалась заметно удачнее. На снимке Дрейк сидит на деревянной скамье в восьмиугольной комнате с камерой в руках.
Мужчина с эспаньолкой в тёмно-синей толстовке сидит на деревянной скамье в деревенской восьмиугольной комнате, держа камеру на коленях
Мужчина с эспаньолкой в тёмно-синей толстовке сидит на деревянной скамье в деревенской восьмиугольной комнате и держит двухобъективную камеру
Без типичных артефактов не обошлось: надпись Rolleiflex на двухобъективной камере превратилась в невнятный набор букв, ремни стали полупрозрачными, а пальцы словно проходят внутрь корпуса. Зато сходство с реальным Джорданом Дрейком получилось почти пугающе точным.
Другие нововведения и доступность
Помимо более точной работы с референсами, в Images 2.5 появились и другие улучшения:
- модель умеет превращать наброски и каракули в полноценные изображения;
- генерация стала на 50% быстрее;
- по словам OpenAI, картинки получают «более естественное освещение и богатые текстуры»;
- модель лучше выполняет инструкции по редактированию «на протяжении нескольких шагов» диалога.
Images 2.5 уже доступна пользователям ChatGPT в десктопном и мобильном приложениях, а также в веб-версии. Кроме того, новая модель работает в Codex и ChatGPT Work.
Первые тесты показывают, что прогресс реален, но результат пока нестабилен: одна и та же модель может выдать как неузнаваемого рыцаря, так и почти неотличимый от оригинала портрет. Поэтому к «отредактированным» в ChatGPT снимкам по-прежнему стоит относиться как к новым изображениям, а не к правке исходной фотографии.



















