Структура промптов для Stable Diffusion: веса, негативы, примеры

Промпт
Wide editorial hero image, 16:9. Scene: deep near-black background #0A0A0F, a dark minimal workspace in darkness. Subject: a glowing translucent panel floating in the center, from which a stream of small abstract glowing tiles flows left to right and gradually assembles into a softly lit framed landscape picture of a mountain lake at dawn. Details: photoreal 3D render, matte dark surfaces, amber #F5A623 emissive edges and glow, subtle particle haze, soft reflections on a glossy dark floor. Composition: horizontal flow, eye-level, subject centered-right, generous negative space on the left, high contrast, calm technical mood. Constraints: absolutely NO text, NO letters, NO logos, NO numbers, NO watermark, no brand marks, NO people, NO human figures. Palette: near-black with amber #F5A623 accents only. Use: blog article cover about writing prompts for Stable Diffusion image generation.
Главное:
- Промпт для Stable Diffusion строится по порядку: объект, сцена и свет, композиция, стиль и качество.
- Скобки меняют вес слова: (word:1.2) усиливает, (word:0.8) ослабляет; держите веса в пределах 0,7–1,5.
- Негативный промпт должен быть коротким, до 15–20 слов, и закрывать конкретные дефекты, а не всё подряд.
- SD 1.5 и SDXL понимают английский лучше русского, а SD 3.5 и Flux лучше читают связные фразы.
- Flux не поддерживает негативы, и веса ему почти не нужны: описывайте то, что хотите увидеть.
Хорошая структура промптов для Stable Diffusion важнее длинных списков «волшебных слов»: модель читает запрос по порядку, делит его на блоки токенов и сильнее всего цепляется за начало. Ниже — как собрать промпт из четырёх частей, как работают скобки и веса, что писать в негативный промпт и чем отличаются запросы к SD 1.5, SDXL, SD 3.5 и Flux. Если вы ещё выбираете, ставить ли модель на свой компьютер, начните с разбора что такое Stable Diffusion и какое железо ей нужно.
Как устроена структура промптов для Stable Diffusion
Рабочая структура промптов для Stable Diffusion — четыре слоя по порядку: объект, сцена со светом, композиция с объективом, затем стиль и качество. Такой порядок советуют и авторы гайдов по SD, и документация библиотеки Diffusers: начинать нужно с того, что изображено, а не с оценок вроде masterpiece.
Разберём слои на одном запросе — этот же каркас подходит для большинства промптов для Stable Diffusion, от портрета до пейзажа.
- Объект. Кто или что в кадре и что делает:
an old fisherman mending a net. - Сцена и свет. Где это происходит и как освещено:
on a wooden pier at dawn, soft golden light, light fog. - Композиция. Кадр, ракурс, объектив:
medium shot, eye level, 85mm lens, shallow depth of field. - Стиль и качество. Медиум и технические ограничения:
documentary photo, natural colors, high detail.
Собранный целиком промпт выглядит так:
an old fisherman mending a net, on a wooden pier at dawn, soft golden light, light fog, medium shot, eye level, 85mm lens, shallow depth of field, documentary photo, natural colors, high detailРуководство Diffusers выделяет три обязательных элемента хорошего запроса: объект, стиль и контекст — действие, окружение, настроение. Для фотографичных кадров там же советуют термины съёмки: тип объектива, фокусное расстояние, ракурс, глубину резкости. Конкретное 85mm lens, shallow depth of field описывает кадр точнее, чем «красивое размытие».
Язык тоже часть структуры. Stable Diffusion 1.5 обучали в основном на английских подписях, и в карточке модели прямо сказано: с другими языками она работает хуже. Поэтому промпты для Stable Diffusion на базе 1.5 и SDXL пишут по-английски, а русский черновик сначала переводят.
Второе ограничение — длина. В интерфейсе AUTOMATIC1111 промпт длиннее 75 токенов расширяется до 150 и режется на блоки по 75 токенов, которые модель обрабатывает независимо. Токен — это кусок слова, поэтому 75 токенов заканчиваются быстрее, чем кажется. Главное ставьте в первый блок: это правило одинаково для коротких и длинных промптов для Stable Diffusion. Если нужно разделить смысловые части явно, есть ключевое слово BREAK заглавными буквами: оно добивает текущий блок пустыми токенами и начинает новый. Так фон и персонаж не смешиваются в одном блоке.

Веса и скобки: как усилить или ослабить слово
Вес слова в промпте меняется скобками: круглые скобки усиливают внимание модели к слову, квадратные ослабляют, а число после двоеточия задаёт точный множитель. Синтаксис описан в документации AUTOMATIC1111 и поддерживается большинством интерфейсов на её основе.
Базовые правила синтаксиса:
(word)— внимание к слову растёт в 1,1 раза.((word))— в 1,21 раза, потому что множители перемножаются: 1,1 × 1,1.[word]— внимание падает в 1,1 раза.(word:1.5)— вес ровно 1,5.(word:0.25)— вес в четыре раза меньше обычного.
Явная запись с числом удобнее вложенных скобок: её легче читать и править. Вместо (((red scarf))) пишите (red scarf:1.3) — сразу видно, насколько усилен шарф.
Главная ошибка с весами — перегнуть. Авторы гайдов советуют держаться диапазона 0,7–1,5. Когда вес уходит за 2,0, картинка разваливается: плывут цвета, пропадают детали, композиция ломается. Если объект не появляется даже при 1,4, проблема обычно не в весе, а в формулировке или порядке — поднимите слово ближе к началу промпта.
Скобки в промпте служебные, поэтому буквальные скобки нужно экранировать обратным слешем. Например, имя персонажа с уточнением пишется так: anime_\(character\). Без слеша интерфейс примет его за изменение веса.
Кроме весов, у AUTOMATIC1111 есть ещё два полезных приёма.
- Смена промпта по ходу генерации. Запись
[from:to:when]подменяет часть запроса на заданном шаге или доле шагов. Например,[forest:city:0.3]сначала строит общую композицию леса, а потом дорисовывает детали города. - Чередование. Запись
[cow|horse] in a fieldменяет варианты на каждом шаге, и на выходе получается гибрид двух объектов.
Оба приёма пригодятся, когда хочется смешать понятия, а обычный запрос выдаёт одно из них. Для повседневной работы хватает двух-трёх весов в промпте. Хороший ориентир при написании промптов для Stable Diffusion — усиливать только то, что модель упорно теряет. Если вы усиливаете всё подряд, модель теряет ориентиры так же, как и без весов вовсе.

Негативный промпт: что писать и чего избегать
Негативный промпт — отдельное поле, где перечисляют то, чего в кадре быть не должно; работает он лучше всего коротким и точным. В AUTOMATIC1111 это называется negative conditioning: модель уводит генерацию от описанных там признаков.
Типичная ошибка новичка — скопировать чужой негатив на сто слов. Такой список больше мешает, чем помогает: модель получает слишком много запретов и хуже следует основному промпту. Гайды по SD советуют держать негатив в пределах 15–20 слов и добавлять термины по категориям, когда видите конкретный дефект.
Удобно держать короткие наборы под каждую проблему и хранить их рядом с библиотекой своих промптов для Stable Diffusion.
- Руки:
bad hands, extra fingers, mutated hands. - Лицо:
distorted face, asymmetrical eyes. - Композиция:
cropped, bad composition. - Качество:
blurry, low resolution, jpeg artifacts.
Порядок работы такой. Сначала генерируете без негатива или с минимальным набором вроде blurry, low resolution. Смотрите, что именно сломалось. Потом добавляете одну категорию и генерируете снова с тем же seed. Так видно, какое слово на что повлияло.
Не всё решается негативом. Карточка Stable Diffusion 1.5 честно признаёт: модель не умеет рисовать читаемый текст, а лица и люди могут выходить неправильно. Никакой негатив вроде bad text этого не исправит — это предел самой модели. Для надписей в кадре нужна другая модель, а для лиц — версия новее или дорисовка отдельным проходом.
Ещё одна ловушка — отрицания внутри основного промпта. Фраза a street, no cars часто даёт улицу с машинами: модель видит слово cars и рисует их. Всё, что нужно убрать, переносите в поле негатива, а в основном промпте описывайте то, что должно быть на месте убранного: an empty street.
Примеры промптов для Stable Diffusion под разные задачи
Готовые примеры промптов для Stable Diffusion ниже собраны по той же схеме — объект, сцена, композиция, стиль — и снабжены коротким негативом. Берите их как шаблон и меняйте блоки под свою задачу.
Портрет. Для SDXL и похожих моделей:
portrait of a young woman with freckles, (red knitted scarf:1.2), autumn park, overcast soft light, close-up, 85mm lens, shallow depth of field, film photo, natural skin textureНегатив: distorted face, asymmetrical eyes, blurry, extra fingers.
Предметная съёмка. Для карточки товара или баннера:
ceramic coffee mug on a light oak table, morning window light from the left, top-down view, clean minimal background, product photography, soft shadows, high detailНегатив: cropped, cluttered background, low resolution.
Пейзаж. Здесь помогает BREAK, чтобы небо и передний план не спорили:
mountain lake at sunset, pine trees on the shore, wide shot, BREAK dramatic clouds, orange and violet sky, reflection on calm water, landscape photographyНегатив: blurry, oversaturated, jpeg artifacts.
Иллюстрация. Для аниме-стиля или книжной графики:
a girl reading under a big tree, (lofi illustration:1.2), warm evening light, full body, soft pastel colors, clean linesНегатив: realistic, photo, extra limbs.
Обратите внимание на негатив к иллюстрации: realistic, photo страхует от смешения стилей. Конфликт стилей — одна из частых ошибок: запрос вида «anime, realistic photo» даёт невнятный гибрид.
Когда промпт не срабатывает, меняйте одну вещь за раз. Если одновременно поправить объект, вес и негатив, уже не понять, что помогло. Сохраните seed, правьте один блок, сравнивайте. Такая методичная генерация промптов для Stable Diffusion быстрее приводит к результату, чем перебор десятка случайных вариантов. Больше формул под фотосъёмку — в статье промт для фото нейросети.
Промпты для SD 3.5 и Flux: что меняется в новых моделях
В новых моделях промпт всё меньше похож на список тегов: SD 3.5 и Flux лучше понимают связные предложения, а веса и негативы у них работают иначе или не работают вовсе. Поэтому привычные приёмы написания промптов для Stable Diffusion 1.5 при переходе на новые версии придётся пересмотреть.
Stable Diffusion 3.5 Large устроена иначе, чем 1.5. Вместо одного текстового энкодера CLIP ViT-L/14 у неё три: OpenCLIP-ViT/G, CLIP-ViT/L и T5-xxl. T5 — языковая модель, она разбирает грамматику и связи между словами. В карточке SD 3.5 Large заявлены улучшения в качестве изображения, типографике и понимании сложных промптов. На практике это значит, что предложение «старый рыбак чинит сеть на деревянном причале, туманный рассвет за спиной» передаёт отношения между объектами точнее, чем набор тегов через запятую. В примере кода из карточки модели используются 28 шагов и guidance_scale 3,5 — хорошая стартовая точка для своих экспериментов.
Flux ушёл ещё дальше. Его делает Black Forest Labs — команда, в которую входят авторы Latent Diffusion и Stable Diffusion. Документация BFL прямо говорит: модели FLUX не поддерживают негативные промпты. Вместо «no people» нужно описать, что должно быть на этом месте: пустую улицу, одинокий пейзаж. А руководство Diffusers отмечает, что взвешивание промпта новым моделям вроде Flux не обязательно помогает: они и без скобок хорошо следуют запросу.
Как перевести промпт от SD 1.5 под новую модель:
- Уберите скобки и числовые веса — важное просто поставьте в начало.
- Перенесите смысл негатива в позитивное описание: вместо
blurry— «чёткий снимок, резкий фокус на лице». - Склейте теги в одно-два предложения с глаголами и предлогами.
- Оставьте фотографические термины: объектив, ракурс, свет работают везде.
Если ставить SD локально нет желания, те же приёмы можно проверить онлайн. В каталоге IskraGen есть Flux-2 Pro от 6 ₽ за картинку: модель от авторов Stable Diffusion, где промпт пишется связным текстом без весов и негативов. Оплата в рублях, зарубежная карта не нужна, установка на компьютер тоже. Для сравнения стилей рядом лежат Seedream 5.0 Pro от 10 ₽ и Qwen Image 3.0 от 7 ₽.
Последний совет универсален для любой версии: не переносите промпт между моделями без правок. Запрос, отточенный под SDXL со скобками и длинным негативом, в Flux даст хуже результат, чем простое честное описание кадра.
Частые вопросы
Попробовать Flux-2 - Pro Text to Image в IskraGen
Генерация без VPN, оплата в рублях через СБП. Первые генерации — за минуту.
Похожие статьи

Как пользоваться Нано Банана: интерфейс, промпт и частые ошибки
25 сентября 2026 · 9 мин чтения

Промпты для Midjourney: параметры, стили и референс персонажа
25 сентября 2026 · 10 мин чтения

Лучшие нейросети для фото: сравнение моделей и цен в 2026
22 сентября 2026 · 10 мин чтения

Нейросеть для рекламы: креативы, баннеры и ролики под задачу
22 сентября 2026 · 9 мин чтения

Нейросеть для генерации изображений по фото: как это работает
22 сентября 2026 · 11 мин чтения