Материал редакции Зерокодера. Рекламные картинки для наших курсов рисуются генерацией по API, поэтому правила промпта проверены на потоке. Обновлено: сентябрь 2026.
Промпт для фото в ГПТ собирается из шести блоков: задача, сцена, субъект, свет и оптика, текст в кадре, ограничения. Официальный гайд OpenAI по промптингу изображений формулирует ту же логику — «organize the prompt as scene, subject, details, and constraints, using labeled sections». Размер кадра и качество живут отдельно от текста запроса: это параметры, и слова про формат внутри промпта модель часто пропускает.
Главное:
- Секретного синтаксиса у промпта нет. Документация OpenAI прямо перечисляет равноправные формы записи: «Short prompts, descriptive paragraphs, JSON-like structures, instructions, and tags can all express the same intent».
- Запрос «сделай красивое фото» отдаёт решение о свете, позе и фоне самой модели. Рабочий промпт называет материал, источник света, кадрирование и запреты.
- Надпись внутри кадра заказывается дословно и в кавычках, с указанием, сколько раз она должна появиться.
- Формат кадра задаётся параметром размера. Наш прод-прибор фиксирует: на «16:9» в тексте промпта модель отдаёт квадрат 1024×1024.
- Сохранение лица промптом не гарантируется. Официальный гайд советует вклеивать утверждённую правку в исходник композитом, когда область должна остаться пиксельно точной.
Из чего собирается промпт для фото в ГПТ
Промпт для фото в ГПТ — это техническое задание на кадр, и у него шесть смысловых блоков. Порядок блоков взят из официального гайда OpenAI по промптингу изображений: «Define the result. Name the subject and intended use… For complex requests, organize the prompt as scene, subject, details, and constraints, using labeled sections».
| Блок | Что в нём | Что ломается без него |
|---|---|---|
| Задача | назначение кадра: карточка товара, обложка поста, портрет | модель выбирает жанр сама |
| Сцена | место, поверхность, фон, время суток | случайный фон и лишние предметы |
| Субъект | объект или человек, кадрирование, поза, взгляд | обрезанные ноги, отвёрнутое лицо |
| Свет и оптика | источник света, направление тени, ощущение фокусного расстояния | плоский свет, пластиковая кожа |
| Текст | дословная надпись в кавычках, шрифт, место, число повторов | набор похожих на буквы значков |
| Ограничения | чего в кадре быть не должно | водяные знаки, вторые логотипы, лишние руки |
Два блока люди пропускают чаще всего — свет и ограничения. Про свет гайд OpenAI уточняет важное: камерные характеристики модель читает как подсказку о внешнем виде, точной физической симуляции они не обещают. Строка «85 мм, f/1.4» работает как описание вида кадра, поэтому рядом стоит писать словами: мягкий свет, малая глубина резкости, тень уходит вправо.
Общие приёмы работы с запросами к моделям разобраны отдельно — в материале как писать эффективные промты для нейросети и в разборе структуры идеального промпта. Соседние разборы этого кластера: промпт для фото — общий разбор запросов на фотографию, и промпт для фото 3х4 — отдельный случай документного кадра.
Мини-вывод: блок «ограничения» экономит больше итераций, чем любое красивое прилагательное в описании сцены.
Промпт-каркас Зерокодера на шесть блоков: готовый промпт для фото
Ниже — полный рабочий промпт целиком. Каркас написан редакцией Зерокодера 9 сентября 2026 года, формулировки блоков сверены с официальным гайдом OpenAI по промптингу изображений. Копируется как есть, меняются только значения.
ЗАДАЧА: фотография товара для карточки на маркетплейсе, вертикальный кадр.
СЦЕНА: светлая студия, столешница из светлого дуба, на заднем плане мягкая
тканевая драпировка холодного серого оттенка, фон размыт.
СУБЪЕКТ: стеклянный флакон сыворотки 30 мл с матовой чёрной крышкой, стоит
по центру кадра, этикетка развёрнута к камере и читается полностью,
рядом на столешнице одна капля жидкости.
СВЕТ И ОПТИКА: рассеянный свет из окна слева, мягкая тень уходит вправо,
камера на уровне этикетки, малая глубина резкости, ощущение съёмки на 85 мм.
ТЕКСТ: на этикетке ровно один раз, кириллицей, надпись «СЫВОРОТКА 30 МЛ»,
строгий гротеск, крупно, по центру этикетки, без переносов.
ОГРАНИЧЕНИЯ: не добавлять другие надписи, логотипы, водяные знаки, руки,
людей и отражения посторонних предметов; фон не заменять на градиент;
вторую упаковку не дорисовывать.
Разбор по строкам. Слово «маркетплейс» в блоке задачи задаёт жанр: белый или светлый фон, товар целиком, никакого художественного обрезания — это дешевле, чем перечислять признаки жанра руками. Строка сцены отвечает за фон и материал поверхности, потому что без неё модель ставит товар на случайную текстуру. В блоке субъекта критична фраза «этикетка развёрнута к камере и читается полностью»: она превращает этикетку из декорации в обязательный к отрисовке элемент. Блок света переводит технический жаргон в наблюдаемые признаки. Блок текста собран по правилу гайда OpenAI: «Put required wording in quotes and describe its position and typography… Ask for no extra text, then check spelling and legibility in the output». Блок ограничений закрывает четыре типовых артефакта генерации — лишние надписи, чужие логотипы, руки в кадре и дубли упаковки.
Мини-вывод: промпт-каркас Зерокодера на шесть блоков переносится на любой предметный кадр заменой значений внутри строк.
Как задать размер и соотношение сторон в промпте для фото
Размер кадра задаётся параметром запроса, и это отдельная от текста промпта сущность. Гайд OpenAI формулирует правило одной строкой: «Set API parameters separately from the prompt». Дальше идут числа, которых в русских подборках промптов нет.
Штатные размеры GPT Image 2.5: 1024×1024 (квадрат), 1536×1024 (альбом), 1024×1536 (портрет), 2048×2048 (2K), 2048×1152, 3840×2160 и 2160×3840 (4K). Для произвольного размера действуют четыре ограничения из документации: каждая сторона не длиннее 3840 пикселей, обе стороны кратны 16, отношение длинной стороны к короткой до 3:1, общее число пикселей от 655 360 до 8 294 400. Всё, что крупнее 2560×1440, документация помечает как экспериментальное.
Практическое следствие снято на нашем производстве. В генераторе рекламных баннеров Зерокодера (файл goliath/skills/skill-door-launch/banners.py) в докстринге зафиксировано: «gpt-image-2 соотношение сторон из промпта не слушается — на „16:9“ отдаёт 1024×1024». Поэтому прямоугольные баннеры мы получаем отдельным шагом, а формат просим параметром. Проба снята на модели gpt-image-2 второго сентября 2026 года; на GPT Image 2.5 мы её не переснимали. В окне ChatGPT параметр за пользователя выставляет сам ассистент, поэтому просьба словами там срабатывает чаще, чем в прямом обращении к модели.
Мини-вывод: соотношение сторон сверяется по свойствам готового файла в пикселях.
Промпт для обработки своего фото в чат ГПТ
Промпт на обработку загруженного фото строится по другому правилу, чем промпт на генерацию с нуля: сначала называется единственное изменение, затем перечисляется всё, что обязано остаться прежним. Формулировка гайда OpenAI: «Separate changes from constraints. For edits, say „change only X“ and list the details to preserve, such as identity, geometry, layout, lighting, or labels».
Измени только одежду на фотографии.
Не меняй лицо, черты лица, тон кожи, форму тела, позу и причёску.
Сохрани точное сходство, выражение лица и пропорции.
Замени пиджак на бежевое пальто длиной до колена, плотная шерсть,
посадка по фигуре, естественные складки ткани.
Свет, тени и цветовую температуру согласуй с исходным кадром.
Не меняй фон, ракурс, кадрирование и качество изображения.
Не добавляй аксессуары, надписи, логотипы и водяные знаки.
Честная граница метода описана в том же гайде: «Repeated edits can still change details you intended to preserve… If a region must remain pixel-identical, composite the approved edit into the original image instead of relying on prompting alone». По-русски: серия правок постепенно уводит лицо, и если участок обязан совпасть пиксель в пиксель, его вклеивают в исходник в редакторе. Формулы вида «сохрани лицо, возраст, черты внешности», которые кочуют по подборкам промптов, снижают дрейф, гарантии не дают.
Если референсов несколько, гайд советует назначить каждому роль: «Identify each input by number and purpose: subject, style, clothing, or background». То есть в промпте пишется «изображение 1 — человек, изображение 2 — одежда»; формулировка «вот картинки» роль ни одному файлу не назначает. Готовые формулировки под ретушь собраны в нашем разборе топ промтов для обработки фото.
Мини-вывод: одна правка за итерацию и повтор списка сохраняемого в каждом следующем запросе.
Как заказать надпись на русском внутри фото
Надпись внутри картинки заказывается дословной цитатой, с местом, начертанием и числом повторов. Правило из гайда OpenAI по промптингу: требуемый текст ставится в кавычки, редкие слова и названия брендов диктуются по буквам, отдельной строкой запрашивается отсутствие любого другого текста.
Ожидания стоит держать в рамках официальной оговорки. В разделе ограничений документации по генерации изображений сказано: «Text Rendering: Although significantly improved, the model can still struggle with precise text placement and clarity». Разбор на Хабре от 10 августа 2026 года описывает кириллицу в GPT Image 2 как закрытый вопрос; документация вендора осторожнее, и проверять написание глазами всё ещё приходится.
Два рабочих приёма. Первый: для мелкого текста, плотных подписей и нескольких шрифтов гайд советует сравнить качество medium и high, а для диаграмм и слайдов брать high. Второй: просить надпись «ровно один раз» — иначе модель дублирует её на второй плоскости кадра.
Мини-вывод: надпись в кавычках плюс запрет на любой другой текст закрывают большинство случаев «набора значков» вместо слова.
Частые ошибки в промптах для фото и способ их починить
Ошибки в промптах для фото повторяются от подборки к подборке, и все четыре чинятся дописыванием одной строки.
- Оценочные слова вместо признаков. «Красиво», «профессионально», «дорого» модель трактует произвольно. Замена: материал, свет, поверхность, глубина резкости.
- Отсутствие блока ограничений. Без него в кадр приходят водяные знаки и посторонние надписи. Замена: перечисление запретов последней строкой.
- Пачка правок одним сообщением. Гайд OpenAI советует обратное: «request one change, and repeat the details to preserve». Замена: одно изменение за итерацию.
- Ожидание формата от слов. Просьба «сделай 16:9» внутри промпта к модели напрямую не меняет размер холста. Замена: параметр размера из списка штатных значений.
Отдельная строка про доступ. Россия отсутствует в официальном списке поддерживаемых стран OpenAI, где перечислены, например, Казахстан, Сербия и Украина; на самой странице сказано, что доступ к сервисам за пределами перечисленных территорий может привести к блокировке аккаунта. Это условие стоит учитывать до того, как промпты уйдут в рабочий процесс компании.
Мини-вывод: у каждой типовой ошибки есть ровно одна ремонтная строка, и она короткая.
Чек-лист приёмки кадра из ГПТ
- Надпись прочитана по буквам и совпадает с текстом в кавычках.
- Размер кадра сверен по свойствам файла в пикселях.
- Лишние надписи, логотипы и водяные знаки отсутствуют.
- Руки и пальцы пересчитаны, геометрия товара не переписана.
- Для серии: второй кадр сверен с первым по свету и цвету фона.
- Для правки своего фото: лицо сравнено с исходником при 100% масштабе.
Частые вопросы о промптах для фото в ГПТ
На каком языке писать промпт для фото. Русский промпт модель понимает; надпись, которая должна попасть внутрь кадра, пишется дословно и в кавычках на нужном языке. Диктовка редких слов по буквам — рекомендация самого гайда OpenAI.
Нужны ли теги и специальный синтаксис. Документация OpenAI отвечает прямо: короткий промпт, абзац описания, JSON-подобная структура, инструкции и теги передают одно и то же намерение, поэтому формат выбирается по удобству чтения и правки.
Сколько ждать картинку. В разделе ограничений документации указано: сложные промпты обрабатываются до двух минут.
Что нового в моделях изображений. 8 сентября 2026 года в changelog OpenAI появилась запись о выпуске GPT Image 2.5 Sunburst и GPT Image 2.5 Flare для генерации и редактирования; обе модели поддерживают новые ступени качества xhigh и max и тарифицируются по ставкам GPT Image 2 — 30 $ за миллион выходных токенов изображения.