Один и тот же запрос к нейросети может дать мусор или результат профессионального уровня — разница только в формулировке. «Сделай красивую картинку» возвращает случайный сток, а три предложения с конкретикой — кадр, который не стыдно повесить на стену.
Этот гайд закрывает вопрос промтов целиком: как писать запросы для чатов и текстов, изображений, фотосессий по своему фото, видео, музыки и озвучки. Внутри — универсальная формула, разбор живых примеров (в том числе реальных промтов, которые уже сотни раз сработали у пользователей), типовые ошибки и чек-лист для самопроверки. Сохраните страницу — она пригодится при каждой генерации.
Содержание
- Что такое промт и почему от него зависит 80% результата
- Как нейросеть читает ваш промт
- Универсальная формула промта: 6 элементов
- Промты для чатов и текста
- Промты для генерации изображений
- Фотосессии по своему фото (промт + референс)
- Промты для видео-нейросетей
- Промты для музыки
- Промты для озвучки и диалогов
- 10 ошибок, которые портят результат
- Чек-лист идеального промта
- Частые вопросы
Что такое промт и почему от него зависит 80% результата
Промт (англ. prompt — «подсказка») — это текстовое задание для нейросети. Всё, что модель знает о вашей задаче, она берёт из промта. У неё нет доступа к вашим мыслям: если вы не написали, что картинка нужна вертикальная для сторис, — получите горизонтальную. Если не сказали «для детей 7 лет» — получите текст для взрослых.
Рабочая метафора: нейросеть — это гениальный, но очень буквальный исполнитель. Он выполнит задание ровно так, как вы его сформулировали, — со всеми вашими недомолвками. Поэтому качество результата почти всегда упирается не в возможности модели, а в качество задания.
Как нейросеть читает ваш промт
Два факта, после которых промты писать проще:
- Модель не понимает смысл — она предсказывает продолжение. Языковые модели (GPT, Claude, Gemini, DeepSeek) генерируют наиболее вероятное продолжение вашего текста. Поэтому промт «Напиши статью о…» даёт «статью вообще», а промт с ролью, аудиторией и форматом заставляет модель предсказывать текст именно в нужном ключе.
- Внимание модели ограничено. В длинном промте детали из середины теряются чаще, чем из начала и конца. Поэтому самое важное — в начало, критичные ограничения дублируйте в конце, а промт не раздувайте: для картинки достаточно 30–80 слов.
Генераторы изображений (Nano Banana, Flux, Midjourney) работают по той же логике, только «продолжением» текста становится картинка. Каждое слово промта голосует за свой визуальный признак: напишете «закат» — получите тёплые тона, напишете «35мм, малая глубина резкости» — получите размытый фон.
Универсальная формула промта: 6 элементов
Формула работает для текста, картинок, видео и музыки — меняется только наполнение элементов. В порядке убывания важности:
Минимальный рабочий промт — элементы 1+2. Полноценный — все шесть. Дальше разбираем, как формула применяется к каждому типу нейросетей.
Промты для чатов и текста
Текстовые модели — в AI-чате (GPT, Claude, Gemini и другие) — лучше всего реагируют на роль, контекст и явный формат ответа.
ПлохоЧто изменилось: появились роль (SMM-специалист), площадка (Telegram), аудитория, объём, ограничения (без эмодзи) и структура концовки. Модели нечего додумывать — все решения приняли вы.
Приёмы, которые заметно улучшают ответы чата
- Дайте образец (few-shot). «Вот пример моего стиля: [текст]. Напиши ещё три поста в том же стиле» — работает надёжнее любого описания стиля словами.
- Разбейте сложное на шаги. «Сначала составь план из 5 пунктов, покажи мне, потом пиши» — промежуточный контроль дешевле, чем переписывать готовый текст.
- Уточняйте итерациями. Не выбрасывайте ответ целиком: «оставь структуру, сделай абзац 2 короче и добавь цифры». Диалог с уточнениями почти всегда быстрее, чем попытка написать идеальный промт с первого раза.
- Просите варианты. «Дай 3 разных варианта заголовка и кратко объясни, чем они отличаются» — так вы получаете выбор, а не один случайный ответ.
Промты для генерации изображений
Для генераторов картинок — Nano Banana 2, Flux 2, GPT Image 2, MiniMax, Midjourney — работает визуальная шестёрка. Отвечайте на вопросы в таком порядке:
| Элемент | Вопрос | Пример формулировки |
|---|---|---|
| Объект | Кто/что в кадре? | девушка с рыжими волосами в пальто оверсайз |
| Действие | Что происходит? | идёт по улице, оборачивается к камере |
| Локация | Где? | вечерняя улица после дождя, неоновые вывески |
| Стиль | Как выглядит? | фотореализм / акварель / аниме / 3D-рендер |
| Свет | Какое освещение? | мягкий свет заката, отражения на мокром асфальте |
| Камера | Ракурс и план? | портретный объектив 85мм, малая глубина резкости, по пояс |
Практические правила для изображений
- Конкретика вместо оценок. «Красивый», «качественный», «лучший» почти ничего не дают. Работают измеримые признаки: «макросъёмка», «симметричная композиция», «пастельная палитра».
- Избегайте отрицаний. Запрос «улица без людей» многие модели понимают как «улица, люди». Вместо этого описывайте желаемое: «пустая улица ранним утром».
- Один стиль — одна генерация. «В стиле Ван Гога и киберпанк и акварель» — получите кашу. Смешивайте максимум два близких стиля.
- Противоречия ломают кадр. «Полуденное солнце» + «ночной город» заставят модель выбрать что-то одно случайным образом.
- Текст на картинке — исторически слабое место всех генераторов. Новые модели (GPT Image 2, Nano Banana) справляются с короткими надписями, но длинные тексты лучше добавлять в редакторе.
Фотосессии по своему фото (промт + референс)
Отдельный жанр — генерация по референсу: вы загружаете своё фото, а промт описывает, в какую сцену себя поместить. Здесь главная задача промта — удержать сходство и задать сцену. Этот формат работает в Nano Banana, GPT Image 2 и Flux 2.
Формула референс-промта: сцена + требование сходства + детали света и стиля. Вот реальный пример из каталога — этот шаблон использовали более 600 раз:
Ещё один рабочий паттерн из каталога — кинематографичная сцена с проекцией старого снимка (570+ использований):
Проверенные фотосессии из каталога — откройте любую и сделайте такой же вариант со своим фото:
Что важно в референс-промтах
- Явно закрепите сходство: «сохрани черты лица с референс-фото на 100%», «не меняй форму лица, глаз, носа, губ». Без этой фразы модель вольно интерпретирует внешность.
- Опишите, что делать с кожей: «сохрани реалистичную текстуру кожи и пор, избегай пластического сглаживания» — частая претензия к ИИ-фотосессиям решается одной фразой.
- Качество референса решает половину дела. Чёткое фото анфас при хорошем свете даёт заметно лучшее сходство, чем смазанный снимок в пол-оборота.
- Не смешивайте много людей без схемы. Если людей несколько, опишите композицию: «отец стоит сзади, мама слева, дети впереди» — иначе модель расставит их сама.
Промты для видео-нейросетей
Видео — самый требовательный к промту формат: Kling, Veo 3.1, Seedance, Sora 2, Gemini Omni и MiniMax генерируют ролики по 5–10 секунд, и за это время должно произойти ровно одно понятное действие.
К шестёрке из раздела про изображения добавляются два обязательных элемента:
- Движение в кадре. Что движется и как: «ветер развевает волосы», «камера медленно наезжает на лицо», «герой поднимает чашку». Без указания движения получите «живую фотографию» с микродрожанием.
- Движение камеры. static shot (статичная), slow zoom in (наезд), orbit (облёт), tracking shot (следование), drone view (с высоты). Термины кинематографа модели понимают хорошо.
Почему «плохой» вариант провалится: четыре действия и сюжетный поворот за 8 секунд — модель смешает их в хаотичное движение. Правило: один ролик = одно действие + одно движение камеры. Нужен сюжет — генерируйте несколько клипов и склеивайте.
Реальный шаблон из каталога (340+ использований) — видео по фото с конкретной сценой и атмосферой:
Больше проверенных видео-шаблонов из каталога — с превью результата, который они дают:
Разбор промта по косточкам
Посмотрим, как устроен профессиональный промт, на примере того самого шаблона «Ночная скамейка в парке» для Seedance. Он длинный — и это нормально для видео. Разложим его на элементы:
Обратите внимание: ничего лишнего. Каждое предложение либо фиксирует сходство, либо описывает свет/звук/движение, либо запрещает артефакт. Именно так выглядит промт, который стабильно срабатывает сотни раз.
Особые режимы видео
- Фото → видео (image-to-video). Промт описывает только движение и атмосферу, сцену модель берёт из кадра: «человек медленно улыбается, волосы шевелит ветер, камера статична». Шаблон оживления старых фото (750+ использований) построен именно так.
- Перенос движения. В Kling Motion Control промт почти не нужен: модель копирует движения с референс-видео на вашего персонажа. Здесь качество зависит от референса, а не от текста.
- Видео со звуком. Veo 3.1 и Sora 2 умеют генерировать звук и речь — реплики указывайте прямо в промте в кавычках, а язык озвучки называйте явно («говорит по-русски»).
Промты для музыки
В Suno промт разделён на два поля, и это частый источник путаницы:
- Стиль (style) — жанр, инструменты, темп, тип вокала, настроение. Пишется тегами через запятую, надёжнее на английском: «emotional pop ballad, female vocals, piano, strings, 75 bpm, heartfelt». Оптимально 5–10 тегов.
- Текст песни (lyrics) — собственно слова. Структуру задавайте метками в квадратных скобках: [Verse], [Chorus], [Bridge]. Без меток модель сама решит, где припев, и это не всегда удачно.
Промты для озвучки и диалогов
В генерации речи — Fish TTS и диалоги ElevenLabs — промтом является сам текст, и главные приёмы здесь другие:
- Пунктуация управляет интонацией. Многоточие — пауза, восклицательный знак — подъём, заглавные — акцент. «Ну… не знаю» и «Ну, не знаю!» модель озвучит по-разному.
- Числа и аббревиатуры — прописью. «В 2026 году» модель может прочитать как попало; «в две тысячи двадцать шестом году» — гарантированно верно.
- Разбивайте длинный текст на абзацы. Сплошная простыня озвучивается монотонно; абзацы дают естественные паузы.
- В диалогах помечайте реплики. Имя говорящего перед каждой репликой («Анна: …», «Марк: …») — иначе модели не различить, кто говорит.
10 ошибок, которые портят результат
- Слишком короткий промт. «Кот» — модель дорисует всё сама, и не факт, что вам понравится её выбор.
- Оценочные слова вместо фактов. «Красиво», «круто», «в хорошем качестве» — ничего не значат. Заменяйте измеримым: «симметричная композиция», «пастельные тона».
- Отрицания. «Без людей» часто даёт людей. Описывайте то, что должно быть, а не чего не должно.
- Противоречия внутри запроса. «Зимний вечер» + «яркое полуденное солнце» — модель выберет случайно.
- Несколько действий в видео. Один ролик — одно действие. Сюжет собирается из нескольких клипов.
- Простыня текста. Промт на 500 слов для картинки — детали из середины будут потеряны. Оптимум 30–80 слов.
- Каша из стилей. Три несочетаемых стиля в одном запросе дают мутный результат. Максимум два близких.
- Ожидание идеала с первой генерации. Профессионалы делают 3–10 итераций: смотрят, что не так, и точечно правят промт.
- Сюжет песни в поле «стиль» у Suno. Стиль — только про звучание, сюжет — в тексте песни.
- Нет проверки результата под задачу. Сверяйте вывод с целью: для сторис нужен 9:16, для презентации — сдержанный стиль. «Красивая картинка» ≠ «подходящая картинка».
Чек-лист идеального промта
Прогоняйте запрос по списку перед отправкой:
- ☑ Есть глагол-действие в начале («напиши», «сгенерируй», «создай»)
- ☑ Объект описан конкретно, без «красивого» и «крутого»
- ☑ Указан контекст: для чего и для кого результат
- ☑ Задан стиль и атмосфера
- ☑ Есть ограничения формата: объём, соотношение сторон, длительность
- ☑ Для видео — одно действие и указано движение камеры
- ☑ Для фото по референсу — закреплено сходство с оригиналом
- ☑ Нет противоречий и отрицаний
- ☑ Длина промта адекватна задаче (картинка — до 80 слов)
И главное: если результат не идеален — не выбрасывайте, а уточняйте. «Оставь композицию, замени фон на ночной город» работает лучше, чем новый промт с нуля.
Частые вопросы
Что такое промт для нейросети простыми словами?
Это текстовое задание: что сделать, в каком стиле, с какими ограничениями. Нейросеть знает о вашей задаче только то, что написано в промте, поэтому конкретика решает всё.
Как написать хороший промт для генерации картинки?
Опишите шесть элементов: кто в кадре, что происходит, где, в каком стиле, с каким светом, с какого ракурса. Пример: «Рыжий кот спит на подоконнике, за окном дождь, тёплый свет торшера, фотореализм, макросъёмка, малая глубина резкости». Попробовать можно в Nano Banana или Flux 2.
Как составить промт для видео-нейросети?
К описанию кадра добавьте движение (что и как движется) и работу камеры (наезд, облёт, статика). Одно действие на один ролик — сложные сценарии из нескольких событий видео-модели пока не тянут. Проверить можно в Kling или Seedance.
На каком языке писать промты — русском или английском?
Современные модели понимают русский. Английский может быть надёжнее у моделей, обученных в основном на англоязычных данных, и нужен для стилевых тегов в Suno. На русском главное — конкретные формулировки без двусмысленности.
Почему нейросеть игнорирует часть промта?
Обычно одна из трёх причин: промт слишком длинный (детали из середины теряются), в запросе есть противоречия, либо деталь описана отрицанием — «без людей» многие модели читают как «люди». Лечится сокращением, устранением противоречий и описанием желаемого вместо запрещённого.
Сколько деталей должно быть в промте?
Для текста — 2–6 предложений. Для изображения — 30–80 слов. Для видео — одно действие и одно движение камеры. Для Suno — 5–10 тегов стиля. Больше не значит лучше: перегруженный промт модель выполняет хуже.