РомазановОбсудить проект

Промпт «фото в 4K» просит убрать тряску камеры. У фотографии её нет

Промпт «фото в 4K» просит убрать тряску камеры. У фотографии её нет
Что узнаешь

По каналам разошёлся промпт: приложите размытое фото, вставьте текст, получите ultra-HD с сохранением лица, цветов и композиции. Раздают его файлом со ссылкой на Google Диск, под постом сотни просмотров.

Я прочитал этот промпт целиком. Он не мошеннический — картинку вы получите, и она будет крупнее исходной. Но примерно половина команд в нём написана не для фотографии, а для видео, и работает вхолостую. А главное обещание — «сохранит лицо и детали» — держится на слове, а не на устройстве модели.

Ниже разбор: что там лишнее, что модель делает на самом деле, переписанный вариант промпта и граница, за которой такое фото нельзя пускать в рекламу.

Почему в промпте для фото просят убрать тряску камеры?

Потому что промпт писали для видео, а заголовок ему сменили на «Photo Edit». Половину команд можно удалить, и результат не изменится: у фотографии таких свойств просто нет.

Вот исходный текст, как он ходит по каналам. Я привожу его целиком, чтобы вы могли проверить меня, а не поверить на слово.

Исходный промптТот самый, из рассылки. Публикую для проверки, а не для использования
Upscale this photo from 144p to true 4K (3840×2160) while preserving the original composition, framing, colors, and motion.

Remove compression artifacts, JPEG blocking, pixelation, noise, banding, and blur. Recover realistic facial features, skin texture, hair strands, clothing details, and environmental textures without creating artificial or distorted features.

Sharpen edges naturally, improve dynamic range and contrast, maintain accurate colors, stabilize any camera shake, and ensure smooth temporal consistency across frames with no flickering or ghosting. Keep the image photorealistic and avoid oversharpening, over-smoothing, or AI-generated artifacts. Output at 4K with the highest possible quality while preserving the original frame rate.

Теперь по словам. motion — движение. stabilize any camera shake — стабилизация тряски камеры. temporal consistency across frames — согласованность между кадрами. no flickering or ghosting — без мерцания и шлейфов. preserving the original frame rate — сохранение частоты кадров. Даже стартовое 144p — это класс разрешения видео, а не фотографии.

У фотографии один кадр. Нет движения, нет соседних кадров, нет частоты кадров. Это промпт для апскейла видео, которому поменяли заголовок на «Photo Edit».

Практического вреда от лишних строк немного: модель их проигнорирует. Вред в другом — вы не понимаете, за что отвечает каждая строка, и не можете промпт починить, когда результат вам не нравится.

Какое разрешение модель отдаёт на самом деле?

4K действительно доступен, но задаётся он не словами внутри промпта. В документации OpenAI для gpt-image-2 размер — это отдельный параметр запроса с жёсткими рамками.

ОграничениеЗначение
Максимальная длинная сторона3840 px
Кратность обеих сторон16 px
Предельное соотношение сторон3:1
Минимум пикселей всего655 360
Максимум пикселей всего8 294 400

Размер 3840×2160 в списке популярных значений есть, так что цифра из промпта достижима. Но фраза Output at 4K внутри текста — это просьба, а не установка параметра. Если размер не задан, вы получите то, что модель сочтёт уместным.

Отдельно стоит отметить честную деталь из той же документации: для gpt-image-2 параметр точности к исходнику менять нельзя, модель обрабатывает каждое входное изображение с высокой точностью по умолчанию. То есть строчка «сохрани детали» в промпте ничего не включает — это уже включено.

Почему нейросеть меняет лицо, даже когда просишь не менять?

Потому что она не увеличивает ваше фото, а рисует новое по его образцу. Обычный апскейлер достраивает пиксели между существующими, генеративная модель пересобирает картинку целиком.

Разница видна там, где в исходнике информации физически нет. Обычный алгоритм в таком месте оставит мягкое пятно. Генеративная модель дорисует правдоподобную деталь — ресницы, шов на ткани, буквы на вывеске. Выглядит это лучше. Соответствует оригиналу — не обязательно.

Документация OpenAI описывает эти модели как генерирующие изображения по текстовому описанию. Это не придирка к формулировке, а объяснение, почему у знакомого человека на «улучшенном» фото едет возраст, форма носа и разрез глаз. Модель не восстанавливает лицо, она его пересобирает по описанию «лицо такого типа».

Отсюда практическое правило. Чем важнее точное соответствие исходнику, тем меньше вам подходит генеративный путь:

  • Скан документа, паспорта, чертежа — генеративный апскейл не подходит, он допишет символы
  • Лицо конкретного узнаваемого человека — подходит плохо, черты поплывут
  • Фотография конкретного товара — подходит плохо, деталь товара изменится
  • Фон, текстура, абстрактная иллюстрация — подходит

Какой промпт работает вместо этого?

Рабочий промпт короче исходного и запрещает конкретные вещи вместо общих просьб. «Сохрани оригинал» модель понимает как угодно, «не меняй форму носа» — однозначно.

Главная строка здесь последняя. Она разрешает модели оставить участок мягким вместо того, чтобы придумать деталь. Именно это отличает реставрацию от дорисовки.

Переписанный промптСкопируйте и приложите фото. Работает в любом чате с загрузкой изображений
Увеличь разрешение этого фото до 3840 пикселей по длинной стороне.

Сохрани композицию, кадрирование, пропорции и цвета исходника.

Черты лица не меняй: форму носа, губы, разрез глаз, линию роста волос, возраст. Форму и цвет предметов на фото не меняй.

Убери артефакты сжатия JPEG, шум, полосы и размытие. Восстанови текстуру кожи, пряди волос, фактуру ткани и фона.

Не добавляй украшения, надписи, логотипы и предметы, которых нет в исходнике. Не разглаживай кожу до пластика и не перешарпливай края.

Если участок нельзя восстановить без домысливания — оставь его мягким. Не выдумывай детали.

Дальше сравните результат с исходником в полном размере, а не в ленте. Смотреть надо на лицо, на текст в кадре и на границы предметов — именно там перерисовка вылезает первой.

Когда такое фото нельзя ставить в объявление?

Когда на фото ваш товар или ваш объект. Правила Яндекс Директа требуют, чтобы изображение соответствовало тексту объявления и содержанию страницы перехода.

Здесь получается развилка, о которой в рассылках не пишут. Те же правила требуют, чтобы изображение было качественным и чётким, без артефактов сжатия, — и это как раз довод в пользу апскейла. Но если модель заодно перерисовала товар, изображение перестаёт соответствовать тому, что человек увидит на странице.

Безопасная граница простая. Чистка шума и артефактов на фото вашего реального объекта — нормально. Генеративная дорисовка того, чего в кадре не было, на фото товара — нет. Если после обработки вы не можете сказать «это тот самый объект», в объявление такое фото не идёт.

Пересъёмка на телефон почти всегда даёт лучший результат, чем спасение старого файла нейросетью. Это скучный совет, поэтому его не раздают файлом на Google Диске.

Как проверить результат за пять минут?

Порядок, который отсекает большую часть проблем:

  1. Откройте исходник и результат рядом в полном размере
  2. Сравните лицо: нос, глаза, линию роста волос, возраст
  3. Прочитайте весь текст в кадре — вывески, этикетки, номера
  4. Проверьте границы товара и его цвет
  5. Посмотрите на руки и на мелкие повторяющиеся детали
  6. Если фото пойдёт в рекламу — спросите себя, узнает ли клиент этот объект вживую

Если хоть один пункт вызывает сомнение, фото годится для ленты, но не для объявления.

Частые вопросы

Этот промпт вообще не работает?

Работает, но не так, как обещано. Модель действительно вернёт картинку крупнее и чище. Проблема в том, что половина команд в промпте относится к видео и на фотографию не действует, а слово «сохрани лицо» не гарантирует сохранения лица — модель рисует изображение заново.

Сколько раз можно прогонять фото через нейросеть?

Каждый прогон — это новая генерация поверх предыдущей, а не уточнение прошлой. Отклонение от оригинала накапливается. Если результат не устроил, возвращайтесь к исходнику и меняйте формулировки, а не обрабатывайте уже обработанное.

Чем тогда пользоваться, если нужна честная реставрация?

Специализированными апскейлерами, которые достраивают пиксели, а не перерисовывают сюжет. Генеративную модель имеет смысл брать там, где перерисовка допустима: фон, абстрактная иллюстрация, изображение без узнаваемого человека и без конкретного товара.

Можно ли ставить такое фото в объявление?

Если на фото ваш товар — рискованно. Правила Яндекс Директа требуют, чтобы изображение соответствовало тексту объявления и содержанию страницы перехода. Перерисованный товар этому требованию может не отвечать, даже если выглядит красиво.

Правда ли, что нейросеть выдаёт 4K?

По документации OpenAI, длинная сторона может быть до 3840 пикселей, и размер 3840×2160 в списке поддерживаемых есть. Но задаётся он параметром, а не фразой «output at 4K» внутри текста промпта.

Стоит ли писать промпт по-английски?

Разницы, которую я мог бы подтвердить ссылкой, я не знаю. Что точно влияет на результат — конкретность: «не меняй форму носа и разрез глаз» работает лучше, чем «сохрани оригинал».

Источники
  1. Документация OpenAI по генерации изображений
  2. Как правильно оформить объявление, Яндекс Директ
  3. Изображения в объявлении, Яндекс Директ