OpenAI представила новую версию своей модели для генерации и редактирования изображений. ChatGPT Images 2.5 стала быстрее, точнее следует инструкциям и лучше справляется с серией последовательных правок.
По заявлению компании, генерация теперь занимает примерно на 50% меньше времени, чем в версии 2.0. Одновременно улучшили визуальное качество: модель точнее работает с текстурами и освещением, а при использовании референсных фотографий лучше сохраняет внешность и ключевые особенности объектов.
Главный апдейт, впрочем, касается редактирования. Images 2.5 должна аккуратнее менять отдельные элементы сцены, не перерисовывая без необходимости все изображение вокруг. OpenAI также улучшила работу с длинными цепочками правок в одном диалоге — после нескольких итераций картинка меньше «расползается», а ранее внесенные изменения сохраняются стабильнее.
Модель получила поддержку прозрачного фона и стала надежнее выполнять сложные композиционные запросы с несколькими объектами, взаимным расположением элементов и большим числом условий.
Новые инструменты
Вместе с моделью OpenAI расширила сам интерфейс генерации.
Появился Sketch — режим, в котором можно использовать собственный рисунок или набросок как основу для будущей генерации.
Также теперь можно выделять конкретные области изображения и оставлять к ним комментарии, объясняя модели, что именно нужно изменить. Для типовых задач добавили готовые шаблоны композиции и верстки.
Две версии для разных задач
В API новое поколение разделили на две модели:
-
GPT-Image-2.5 Flare — облегченная версия с упором на низкую задержку и быструю генерацию.
-
GPT-Image-2.5 Sunburst — более тяжелая модель для задач, где приоритетом становится максимальная детализация и качество результата.
Новая версия постепенно появляется в ChatGPT на вебе и других платформах, а варианты Flare и Sunburst доступны разработчикам через API.
Источник: habr.com