Как писать запрос, чтобы не перегенерировать по десять раз
Разница между «красивый кот» и готовым кадром — в четырёх словах, которые почти никто не пишет.
Структура, которая работает
Объект — окружение — свет — оптика. Вместо «красивый кот» — «рыжий кот в скафандре, студийный контровой свет, 85 мм, неглубокая резкость». Свет и оптика решают больше, чем прилагательные: именно они делают картинку похожей на фотографию, а не на рисунок.
Слова, которые реально меняют кадр
Про свет: мягкий рассеянный, контровой, золотой час, пасмурный день, неоновая подсветка. Про оптику: 35 мм, 85 мм, широкий угол, макро, неглубокая резкость. Про ракурс: съёмка сверху, с уровня глаз, крупный план, общий план.
Частые ошибки
Слишком общо. «Красивый пейзаж» модель трактует как угодно — и вы получите случайность.
Слишком много всего. Пять объектов в одном запросе соревнуются за внимание, и обычно проигрывают все. Один смысловой центр надёжнее.
Отрицания. «Без людей» работает хуже, чем описание того, что должно быть в кадре: «пустая улица на рассвете».
Про текст на картинке
Короткую надпись — два-три слова — модель наберёт настоящими буквами. Абзац мелкого текста превратится в нечитаемый набор символов: генераторы изображений рисуют текст как узор, а не набирают шрифтом. Длинный текст добавляйте поверх кадра в редакторе.
Если исходник уже есть
Не обязательно генерировать с нуля: готовое изображение можно переделать по описанию. Как это работает →