8 сентября 2026 года OpenAI представила ChatGPT Images 2.5 — новую версию своей передовой модели для генерации изображений, которая призвана значительно улучшить творческие рабочие процессы. Еженедельно пользователи создают более 3 миллиардов изображений с помощью ChatGPT Images и моделей GPT-Image в API, и новое обновление направлено на расширение этих возможностей. ChatGPT Images 2.5 обеспечивает более высокую детализацию, точное редактирование и ускоренную генерацию, что позволяет быстрее воплощать идеи в жизнь. Модель также улучшает естественность освещения и насыщенность текстур, лучше сохраняет объекты на референсных фотографиях и более надежно следует инструкциям по редактированию в многоэтапных процессах. Задержка генерации изображений сокращена до 50% по сравнению с Images 2.0, что ускоряет создание и доработку концепций. В ChatGPT появились новые функции, предоставляющие пользователям больше контроля над творческим процессом, включая Sketch для рисования непосредственно в интерфейсе, шаблоны для популярных форматов изображений и возможность комментировать изображения для более целенаправленного редактирования. Пользователи также могут делиться своими промптами, чтобы другие могли использовать их идеи. Images 2.5 доступна всем пользователям ChatGPT, ChatGPT Work и Codex на настольных компьютерах, мобильных устройствах и в вебе. Для разработчиков представлены две новые модели API: GPT-Image-2.5 Flare, предлагающая те же улучшения качества, редактирования и скорости, и GPT-Image-2.5 Sunburst, обеспечивающая дополнительный уровень точности для детализированной творческой работы с более длительным временем генерации.

Повышенная точность и реалистичность изображений

Images 2.5 значительно улучшает работу с референсными фотографиями, позволяя трансформировать знакомые объекты в новые настройки, визуальные стили и композиции. Изображения объектов становятся более узнаваемыми, освещение и текстуры выглядят естественнее, а отличительные черты с большей вероятностью сохраняются. Для команд, использующих API, эта точность делает рабочие процессы, основанные на референсах, более надежными, гарантируя, что вариации остаются привязанными к исходному источнику. Модель лучше понимает сложные визуальные инструкции и преобразует их в связные результаты, обеспечивая более точное содержание для изображений, включающих реальную информацию, и обрабатывая сложные макеты, включая прозрачные фоны. Она также лучше отражает визуальные стили, что позволяет изображениям точнее соответствовать художественному замыслу пользователя.

Улучшенное и последовательное редактирование

Новая модель упрощает целенаправленное редактирование, позволяя получать конечные изображения, более точно соответствующие задуманному. Images 2.5 лучше редактирует только запрошенные элементы, сохраняя остальные детали неизменными, даже при работе со сложными объектами и фонами. Для разработчиков, использующих Images API, это дает возможность обновлять один элемент, такой как продукт, фон или текст, сохраняя при этом объект, композицию и фирменный стиль вокруг него. В ходе длительных бесед в ChatGPT Images 2.5 более надежно следует конкретным инструкциям по редактированию в многоэтапных процессах. Более ранние изменения с большей вероятностью остаются последовательными, и каждое новое редактирование основывается на уже проделанной работе без ухудшения качества изображения со временем. Эта последовательность также важна в производственных рабочих процессах, где разработчикам необходимо вносить целенаправленные изменения без полной перестройки всего актива.

Новые функции для пользователей ChatGPT

В ChatGPT представлены новые функции, расширяющие возможности пользователей. Sketch — это новая функция, позволяющая рисовать непосредственно в ChatGPT и использовать рисунок в качестве референса для конечного изображения. Пользователи могут быстро набросать макет комнаты, контур одежды или просто забавный рисунок, а ChatGPT превратит этот набросок в полноценное изображение. Добавление описания стиля и других деталей позволяет точно отразить видение пользователя. Шаблоны упрощают начало работы с популярными форматами изображений, такими как флаеры и фотографии продуктов. Вместо того чтобы начинать с чистого холста, можно выбрать шаблон, например «Постер» или «Мерч», и добавить детали, такие как информация для передачи, элементы дизайна или стили, чтобы персонализировать результаты. Теперь также можно оставлять комментарии непосредственно на изображениях для более целенаправленного редактирования. Кроме того, пользователи могут делиться промптами, которые они использовали, чтобы другие могли попробовать их идеи со своими собственными фотографиями и деталями.

Новые модели API для разработчиков

Для разработчиков представлены две новые модели в API. GPT-Image-2.5 Flare обеспечивает те же улучшения качества, редактирования и скорости, что и основная модель, и является выбором по умолчанию для большинства приложений, предоставляя более высококачественные изображения, чем GPT-Image-2, при 50% меньшей задержке. Она подходит для широкого спектра задач, от создания контента для авторов и социальных сетей до продуктовых решений, визуального поиска, быстрого прототипирования изображений и высокообъемной генерации. GPT-Image-2.5 Sunburst предназначена для премиальных визуальных рабочих процессов, требующих более строгого контроля над редактированием. Она идеально подходит для творческих и редакторских задач, таких как создание готовых к производству рекламных материалов или отполированных изображений продуктов.

Источник: OpenAI News