OpenAI представила детальное руководство по работе со своей новой моделью генерации изображений GPT-Image-1.5. Компания заявляет, что обновление нацелено не просто на красивые картинки, а на реальные рабочие процессы: от создания инфографики и UI-дизайна до сложного редактирования фотографий с сохранением лиц и объектов.
Главная фишка модели — контролируемость. Теперь нейросеть понимает не абстрактные просьбы, а жесткие технические задания. OpenAI показала, как генерировать логотипы, переводить текст прямо внутри изображений и менять одежду на моделях, не превращая их лица в случайный набор пикселей.
Что умеет новая модель (и как это использовать):
- Редактирование с «заморозкой»: можно заменить один объект (например, кресло в комнате или одежду на человеке), не затрагивая освещение, тени и геометрию кадра. Модель понимает команды «измени только X, остальное не трогай».
- Текст внутри картинок: GPT-Image-1.5 научилась писать без ошибок. Это открывает дорогу для генерации готовых рекламных баннеров, карточек товаров и даже перевода инфографики на другие языки с сохранением верстки.
- Единый стиль: модель может запоминать персонажа. Вы можете создать героя для детской книги и генерировать с ним десятки разных иллюстраций, где он будет выглядеть одинаково.
- Умная инфографика: нейросеть способна создавать сложные схемы (например, устройство кофемашины) и UI-мокапы мобильных приложений, которые выглядят как реальные скриншоты, а не концепт-арты.
Функция редактирования по маске и работа с текстом фактически делают GPT-Image-1.5 конкурентом Canva и базовым инструментам Photoshop. Главный вопрос теперь не «как сгенерировать», а «как правильно составить промпт».
Источник: cookbook.openai.com