Вы пишете «красивый закат над морем, кинематографично» и получаете открытку, каких в интернете миллион. Нейросеть тут ни при чём. Хороший промпт для фото или видео - это короткое задание оператору: кто в кадре, что он делает, где, как стоит камера, какой свет и какой звук. Официальные гайды OpenAI, Google и Runway сходятся в главном: одна сцена, одно действие, одно движение камеры. Ниже формула из 7 блоков, 12 шаблонов под копирование и бонус: промпт, который пишет промпты за вас.
Почему нейросеть выдаёт «не то»
Потому что ей не хватает деталей, и пустоты она заполняет самым обычным вариантом. Промпт (текстовое задание для нейросети) работает как заказ в кафе: скажете «что-нибудь вкусное» - получите самое популярное блюдо меню, а не то, чего хотелось вам.
Генерацией картинок и видео пользуются уже почти все, кто делает контент. Adobe в сентябре 2025 года опросила 16 000 авторов в восьми странах: США, Великобритании, Франции, Германии, Японии, Южной Корее, Индии и Австралии. Генеративный ИИ (нейросети, которые создают новые картинки, видео и тексты) используют 86% из них, а 52% именно генерируют изображения и видео. Но 34% жалуются на ненадёжное качество результата.
Часто дело в словах вроде «красиво» и «кинематографично». В гайде OpenAI по видеомодели Sora прямо советуют заменять «кинематографичный вид» конкретикой: какой объектив, какая глубина резкости (насколько размыт фон), откуда падает свет. Модель не знает, что красиво именно для вас. Зато точно понимает «мягкий свет из окна слева и тёплая лампа сзади».
Значит, нужен порядок, по которому задание собирается каждый раз. Вот он.
Формула промпта: 7 блоков, которые работают везде
Универсальный промпт состоит из семи блоков: кадр, объект, действие, место, свет и цвет, стиль, звук. Google в гайде по Veo 3.1 (октябрь 2025) даёт похожую формулу: операторская работа + объект + действие + контекст + стиль. У Runway порядок другой, камера идёт первой, но набор тот же.
- Кадр. План и ракурс: общий план (wide shot), средний (medium shot), крупный (close-up), снизу (low angle). Это первое, что видит зритель, поэтому и первое, что решаете вы.
- Объект. Кто или что в центре, с 2-3 приметами: «пожилой рыбак в жёлтом дождевике», а не «мужчина».
- Действие. Глаголы и такты. OpenAI советует писать не «актёр идёт по комнате», а «делает четыре шага к окну, останавливается и в последнюю секунду отдёргивает штору».
- Место и время. «Заброшенный склад на закате» точнее, чем «тёмное здание».
- Свет и цвет. Источник света и 3-5 цветовых якорей (основных цветов кадра), например «янтарный, кремовый, ореховый». Якоря держат один стиль в серии кадров.
- Стиль. Носитель и эпоха: фото на плёнку 35 мм, 3D-рендер, акварель, ретро-реклама 80-х.
- Звук (только для видео). Реплики, шумы, музыка - отдельными предложениями.
Для фото звук просто выпадает, для видео добавляется движение камеры. Формула одна, меняется только набор блоков:
- Фото: кадр - объект - место - свет и цвет - стиль - формат кадра.
- Видео: кадр и движение камеры - объект - одно действие - место - свет - стиль - звук.
- Моушен-дизайн кодом: палитра и шрифты - сцены по долям такта - правила сборки - запреты.
Формулу знать мало. Пять типичных ошибок ломают даже правильно собранный промпт.
5 ошибок, которые портят даже хороший промпт
Главная ошибка - писать, чего не надо. Runway в своём гайде объясняет: фраза «без тряски камеры» заставляет модель думать именно о тряске. Пишите, что нужно: «плавная, устойчивая камера».
- Отрицания. Google советует то же: вместо «никаких построек» описать «пустынный пейзаж без зданий и дорог», то есть нарисовать нужную картину. Исключение - Midjourney: там для запретов есть отдельный параметр
--no. - Слишком много событий в одном клипе. Runway просит не писать «потом» и «затем»: одна генерация - одно действие. OpenAI идёт дальше и советует склеить два клипа по 4 секунды вместо одного на 8.
- Пустые слова. «Шедевр», «8k», «очень красиво» не описывают ни свет, ни кадр. Меняйте их на детали.
- Две камеры сразу. «Наезд и облёт вокруг героя» модель выполнит плохо. Runway: одно основное движение камеры на промпт.
- Переписывать всё с нуля. OpenAI советует менять по одной детали за раз: «тот же кадр, объектив 85 мм». Не выходит несколько раз подряд - упростите: камеру остановить, действие сократить, фон очистить.
Теперь самое полезное: готовые шаблоны.
Шаблоны промптов для фото: 5 штук под копирование
Шаблоны написаны на английском: так составлены официальные гайды, и на нём генераторы обычно понимают операторские термины точнее всего. В квадратных скобках - то, что вы меняете под себя. Подходят для генераторов картинок в ChatGPT и Gemini, для Midjourney и большинства других.
1. Портрет для аватарки или резюме
Photorealistic head-and-shoulders portrait of [who: age, appearance, clothing], [expression: calm half-smile], looking slightly off camera. Soft window light from the left, gentle fill, neutral [color] background. Shot on 85mm lens, shallow depth of field, natural skin texture. Vertical 4:5. No text, no logos.Объектив 85 мм - классика портретной съёмки: лицо без искажений, фон мягко размыт. OpenAI советует прямо просить «photorealistic», если нужна именно фотография, а не рисунок.
2. Предметная съёмка товара
Product photo of [product, material, color] on [surface: wet black stone / linen / concrete], [angle: three-quarter view at eye level]. One hard key light from the right, soft reflection, [2-3 color anchors]. Clean premium commercial look, sharp focus on the product, square 1:1, empty space on the left for text. No extra objects, no text.3. Обложка или баннер с текстом
Poster for [what: workshop / sale / podcast]. Main image: [scene]. Headline in bold sans-serif at the top, render exactly once: "[YOUR TEXT]". Spelling: [Y-O-U-R T-E-X-T]. Colors: [3 colors]. Horizontal 16:9. No other text, no watermark.Ошибки в тексте на картинке - самая частая жалоба. OpenAI даёт три правила: точный текст в кавычках, сложные слова и названия брендов - по буквам, и просьба «никакого другого текста».
4. Правка готового фото
Edit this photo. Change only: [what: replace the grey sky with a warm sunset]. Keep identical: the person's face and identity, pose, clothing, framing, lighting direction. Do not add text, logos or extra people.Правило из гайда OpenAI: отделите то, что меняется, от того, что должно остаться, и повторяйте важные ограничения при каждой следующей правке.
5. Серия картинок в одном стиле
Series style, keep for every image: [medium: flat editorial illustration], palette [#hex1, #hex2, #hex3], [light: soft top light], [mood], same line weight and texture. Image [N] of [total]: [scene].Стилевой блок копируется в каждый промпт без изменений, меняется только последняя строка. Так серия выглядит как работа одного автора.
Параметры Midjourney, которые стоит знать
В Midjourney часть настроек пишется после текста через два дефиса. Самые полезные:
--ar 16:9- формат кадра (по умолчанию квадрат 1:1);--s 0-1000- сколько своей эстетики добавит модель (по умолчанию 100; меньше - точнее следует тексту);--c 0-100- насколько разными будут варианты (по умолчанию 0);--no text, logo- что убрать из кадра;--seed 1234- фиксирует случайность, удобно для сравнения правок;--sref [ссылка]- взять стиль с картинки-образца.
Пример: [ваш промпт] --ar 16:9 --s 50 --c 10 --no text. Набор параметров меняется от версии к версии модели, поэтому перед работой сверяйтесь со справкой Midjourney.
С картинками разобрались. В видео добавляется то, чего нет на фото: время.
Шаблоны промптов для видео: 5 штук под копирование
Видеопромпт описывает одно действие и одно движение камеры на 4-10 секунд. Google Veo 3.1 делает клипы по 4, 6 или 8 секунд в форматах 16:9 и 9:16, поэтому длинную историю собирают из нескольких коротких кадров.
6. Один кинематографичный кадр
[Shot: medium shot, slow dolly forward]. [Subject with 2-3 details] [one action, in beats: takes three steps, stops, turns head to camera in the last second]. [Place and time: rain-soaked alley at night]. Light: [neon pink and cold blue, wet reflections]. Style: [35mm film, light grain]. Smooth, stable camera.7. Оживить фотографию
Animate this image. Camera: [slow push-in]. Motion: [hair and scarf move in light wind, she blinks and smiles slightly]. Background: [clouds drift slowly]. Keep the face, clothing and colors exactly as in the image. Calm, natural movement.Картинка уже задаёт внешность и стиль, поэтому весь текст тратьте на движение: что шевелится, куда едет камера, с какой скоростью.
8. Кадр с репликой и звуком
Close-up of [character], [setting]. She looks at the camera and says: "[short line, up to 8 words]". SFX: [door creaks behind her]. Ambient noise: [quiet café chatter]. Warm, natural light.Это синтаксис из гайда Google: реплика в кавычках, звуковые эффекты после SFX:, фон после Ambient noise:. OpenAI добавляет: в 4 секунды влезает одна-две короткие реплики, не больше.
9. Мини-история по таймкодам
[00:00-00:02] Wide shot: [setting], [character] enters frame.
[00:02-00:04] Close-up: [reaction, emotion].
[00:04-00:06] Tracking shot: [key action].
[00:06-00:08] Wide high-angle shot: [final image]. SFX: [music swells].Здесь гайды расходятся. Google показывает таймкоды для Veo как рабочий приём, а Runway советует держать в одном промпте одно действие. Вывод простой: таймкоды пишите, только если модель их поддерживает. В остальных случаях делите историю на отдельные клипы и склеивайте в редакторе.
10. Вертикальный ролик для Reels, Shorts и TikTok
Vertical 9:16. First second: [strong visual hook: object falls into frame / extreme close-up of eyes]. [Subject] [one clear action], centered, large in frame, empty space at the top and bottom for captions. [Bright, high-contrast light]. Handheld but steady camera. Audio: [upbeat beat with a hit on the first second].Вертикальный ролик смотрят с телефона, где мелкие детали теряются. Поэтому объект крупно, по центру, а сверху и снизу остаётся место под подписи.
Но если нужно показать интерфейс, логотип или точный текст, видеомодель часто путает буквы. Для этого есть другой путь.
Моушен-дизайн с ИИ: когда анимацию пишут кодом
Моушен-дизайн (анимированная графика: текст, иконки, интерфейсы, логотипы в движении) лучше делать не видеомоделью, а ИИ-ассистентом для кода: Claude, ChatGPT или Gemini. Видеомодель рисует пиксели и может исказить буквы. Ассистент пишет анимацию как веб-страницу, а программа записывает её кадр за кадром. Текст остаётся чётким, цвета бренда - точными, а правки делаются словами.
Для этого уже есть готовые инструменты. Например, Remotion - библиотека для создания видео кодом на React, и на её сайте прямо написано, что видео можно делать «агентно», через ИИ-ассистента. Но хватает и простого HTML-файла.
Сильные промпты моушен-дизайнеров устроены как техническое задание из шести частей:
- Исходники: продукт, скриншоты, логотип, музыка. Если чего-то нет - что взять по умолчанию.
- Направление: палитра в HEX-кодах (цифровая запись цвета, например #0b1a24), шрифты, список запретов («никаких плавных растворений, частиц, шаблонного вида»).
- Структура по долям такта: музыка 120 BPM (ударов в минуту) - это 2 доли в секунду, 15 секунд = 30 долей. Каждой сцене назначены свои доли.
- Правила сборки: каждый кадр вычисляется только из времени, без случайностей - тогда запись получается одинаковой каждый раз.
- Подводные камни: что уже ломалось и как этого избежать.
- Старт: сначала план и 3-4 стоп-кадра, полная сборка - только после согласования.
11. Промо-ролик продукта на 15 секунд
Make a 15-second product promo for [product + URL] as one HTML file, 1920x1080, 60fps.
Inputs: [screenshots / logo / music]. If missing: study the website first, then ask me.
Direction: one continuous take, every scene grows out of the previous one (buttons become pages, text rises from a mask line). Palette: [#hex x4]. Fonts: [UI font] + [display font]. Banned: crossfades, particles, generic template look.
Structure at [120] BPM, [30] beats:
beats 0-6: [hook: the user's problem in one line of UI],
beats 6-14: [the product solves it: key feature in action],
beats 14-24: [result: numbers or outcome],
beats 24-30: [logo + call to action].
Build: every style is computed from time inside seek(t), no CSS transitions or timers; springs as closed-form functions; render frames with Playwright, add music and sound effects on the beats.
Start: show me the beat map and 4 stills before writing the full film.12. Анимированный логотип на 5 секунд
Animate my logo [file] as a 5-second intro, one HTML file, 1080x1080. The mark draws itself line by line, then fills with [#hex]; the wordmark "[NAME]" rises letter by letter from a mask; a final settle with a light spring. Background [#hex]. Every frame computed from time, so the render is identical each run. Show 3 stills first.Последняя строка в обоих шаблонах - самая важная. Стоп-кадры до полной сборки экономят часы: исправить план дешевле, чем готовый ролик.
А если не хочется заполнять скобки самому, это тоже можно поручить ИИ.
Промпт, который пишет промпты за вас
Самый быстрый способ - попросить ИИ сначала расспросить вас, а потом собрать промпт по формуле. Подходит для любого чат-бота: ChatGPT, Claude, Gemini, DeepSeek.
Бонус. ИИ-помощник для промптов
You are a prompt director for AI image and video generation. Ask me up to 6 short questions, one at a time: what I want to create, where it will be published, format, mood, key details, what to avoid. Then write the final prompt in English using this order: shot, subject, one action, place and time, light and 3-5 color anchors, style, sound (video only). Rules: one camera move, one action, positive wording instead of "no ...", exact text in quotes. After the prompt, give 2 variations that change only one thing each.Последнее правило из этого промпта - про варианты с одной изменённой деталью - и есть метод из гайда OpenAI: сравниваете два результата и сразу видите, что именно сработало. Если вы только начинаете работать с чат-ботами, сначала прочитайте наш гид по ChatGPT, Claude и Gemini.
Осталось понять, когда сгенерированный ролик нужно подписывать.
Нужно ли помечать видео, сделанное ИИ
В Евросоюзе - да, если ролик похож на реальных людей или события. Статья 50 Регламента ЕС об ИИ (AI Act) действует с 2 августа 2026 года. Разработчики генераторов обязаны помечать результат в машиночитаемом виде (скрытой меткой, которую распознаёт программа). Тот, кто публикует дипфейк (поддельное видео, фото или аудио, которое выглядит настоящим), обязан сообщить, что это искусственный контент.
Для творчества есть послабление: если работа явно художественная, сатирическая или вымышленная, о генерации достаточно сообщить так, чтобы не мешать её смотреть. В других странах правила свои, поэтому проверяйте требования площадки, где публикуете.
Простое правило для всех стран: не генерируйте реальных людей без их согласия. Как легко подделать чужой голос, мы разбирали в статье «Сколько секунд нужно, чтобы подделать голос».
Что сделать прямо сейчас
Откройте последний промпт, который дал «не то». Разложите его по семи блокам и посмотрите, какого не хватает. Скорее всего, света или кадра. Допишите один блок и сгенерируйте заново, больше ничего не меняя.
Тот самый закат над морем превращается в «общий план, низкий ракурс, старый деревянный пирс уходит в море, последние десять минут солнца, янтарный и сливовый, плёнка 35 мм». Это уже не открытка. Это ваш кадр.
Источники
- OpenAI: Sora 2 Prompting Guide (2025)
- Google Cloud: Ultimate prompting guide for Veo 3.1 (2025)
- Runway: AI Video Prompting Guide
- OpenAI: Image prompting
- Adobe: Creators' Toolkit Report (2025)
- EU AI Act, Article 50: Transparency obligations
- Gradually: Midjourney Parameters (2026)
- Remotion: programmatic video with React






