Генератор изображений в ChatGPT получил обновление, которое может изменить привычный подход к работе с картинками. Версия ChatGPT Images 2.5 стала на 50% быстрее предыдущей 2.0, но главное изменение произошло не в скорости, а в редактировании.
Теперь модель может изменить отдельный элемент изображения и сохранить остальную сцену практически без вмешательства. Особенно это заметно при серии правок в одном диалоге: после нескольких изменений картинка должна лучше сохранять исходную структуру, вместо того чтобы постепенно превращаться в другой результат.

Качество тоже подтянули. Разработчики улучшили передачу текстур и освещения, а ключевые особенности объектов с референсных фотографий модель теперь сохраняет точнее. Кроме того, она умеет сразу создавать изображения с прозрачным фоном и лучше следует сложным инструкциям по композиции.
Саму систему разделили на два варианта. GPT-Image-2.5 Flare рассчитана на небольшую задержку и более лёгкую работу, а GPT-Image-2.5 Sunburst — на максимальную детализацию. При этом стоимость у них одинаковая: $5 за миллион входных текстовых токенов, $8 за миллион входных токенов изображений и $30 за миллион выходных токенов. Кэшированные запросы стоят $1,25 и $2 соответственно.
Одновременно в ChatGPT появились Sketch для генерации по ручным наброскам, комментарии к отдельным областям изображения и готовые шаблоны вёрстки. Модели доступны в веб-версии, приложениях ChatGPT и Codex, а также через API.
В итоге генерация изображений всё больше превращается из разовой команды в полноценный процесс редактирования. Для бизнеса это может означать меньше ручной работы при подготовке визуалов и более быстрый выпуск контента.
