Вчера, 8 сентября, компания OpenAI официально представила миру новую генеративную модель ChatGPT Images 2.5, которая, судя по словам разработчиков, предоставляет пользователям более высокую детализацию, повышенную точность редактирования изображения и ускоренный процесс генерации финального контента.
«В Images 2.5 нам удалось добиться более естественного освещения и получить более насыщенную текстуру, при этом объекты на ваших оригинальных фотографиях сохраняются лучше, более надёжно выполняются инструкции по редактированию на протяжении нескольких этапов. Мы также сократили задержку генерации изображений до 50% по сравнению с Images 2.0, так что вы сможете создавать изображения и дорабатывать свои концепции быстрее», — говорится в официальном блоге компании.
При этом представители компании отмечают, что новая модель особенно хорошо себя раскрывает во время работы с «эталонными» (оригинальными) фотографиями — можно преображать объекты в новых условиях и сценах, менять композицию и стиль с сохранением этого самого объекта. Например, можно взять фотографию своей собаки и «надеть» на неё костюм гонщика — ИИ не тронет саму собаку или окружающую сцену, а просто дорисует костюм поверх питомца. Выглядит весьма точно, без искажений или артефактов, которые появлялись в предыдущей версии модели.
Кроме того, в Images 2.5 можно редактировать только те элементы, которые нужно пользователю, тогда как все остальные детали в кадре остаются неизменными. Это очень полезная вещь на тот случай, если нужно заменить фон, например, или только головной убор на снимке, а всё остальное оставить в изначальном состоянии. И, что особенно важно, система теперь лучше работает в случае многократного внесения изменений — модель сохраняет согласованность, а каждая новая правка будет основываться на уже проделанной работе.
Но, пожалуй, главное нововведение — система Sketch. Теперь непосредственно в интерфейсе ChatGPT пользователь может запустить режим создания наброска, после чего откроется окно для рисования.
Здесь можно выбирать цвет кисти, добавить текстовые надписи или фигуры и удалять элементы, после чего система проанализирует черновик и на его основе сгенерирует финальное изображение. Преимущество в том, что в определённых сценариях проще нарисовать сцену, чем описывать её, даже если набросок будет не особо точным. А когда скетч уже готов, с ним можно продолжать работу с функциями редактирования, сменой стилей и не только.


