Вы генерируете портрет в Stable Diffusion. Композиция удачная, свет выразительный, но с лицом что-то не так. На коже нет пор, а свет отражается от неё, как от манекена. Каждая деталь отполирована до предела: это тот самый «пластиковый эффект ИИ», который сразу выдаёт машинное происхождение изображения.
В этом руководстве разберём, почему так происходит, какие реалистичные модели Stable Diffusion действительно решают проблему, а также какие настройки и методы постобработки отделяют фотореалистичный результат от пластикового.
Почему изображения Stable Diffusion выглядят пластиковыми
Пластиковый вид не связан с одной конкретной ошибкой. Он появляется из-за трёх накладывающихся факторов, каждый из которых усиливает остальные.
Смещение в данных обучения. Базовые модели вроде SDXL и SD 1.5 обучались на миллионах изображений. Среди них много цифрового ретушированного стокового фото, изображений с аэрографией и картинок, созданных AI и затем возвращённых в обучающую выборку. Модель усваивает, что гладкая безупречная кожа является нормой, поскольку именно она преобладает в распределении данных. Дообученные реалистичные checkpoint исправляют это, обучаясь на неретушированных фотографиях с видимой текстурой кожи, порами и естественными несовершенствами.
Взаимодействие sampler и CFG. Высокие значения CFG выше 7 заставляют модель строго следовать prompt. Часто это приводит к агрессивной генерации идеализированной версии каждого понятия, включая кожу. CFG 8+ в prompt для портрета подавляет высокочастотный шум, который превращается в поры, пятна и микротекстуру. В сочетании с sampler, ставящими связность выше детализации, вы получаете стеклянно-гладкую поверхность, которая при близком рассмотрении выглядит искусственной.
Отсутствие negative prompts. Если явно не сказать модели, чего избегать, она не получает сигнала, что пластиковая, отретушированная, гладкая кожа и кукольный вид нежелательны. Negative prompts нужны не только для удаления лишних пальцев. Это прямой инструмент управления реалистичностью кожи.

Лучшие реалистичные модели в Stable Diffusion сегодня
Не каждый checkpoint рассчитан на фотореализм. Модели ниже заслужили репутацию благодаря стабильному качеству, активной проверке сообществом и измеримому числу загрузок на Civitai. Каждая сильна в своей области реализма.
| Модель | Архитектура | Минимум VRAM | Лучше всего для | Главное преимущество |
|---|---|---|---|---|
| RealVisXL V5.0 | SDXL 1.0 | 8 GB | Портретов, крупных планов | Естественный вид плёнки, текстура кожи |
| Juggernaut XL v10 | SDXL 1.0 | 8 GB | Универсального фотореализма | Кинематографичный свет, широкий диапазон prompt |
| Realistic Vision V6.0 | SD 1.5 | 4 GB | Реализма на слабом железе | Работает на 4 GB, огромная экосистема LoRA |
| CyberRealistic XL v10 | SDXL 1.0 | 8 GB | Чистого фотореализма, быстрых итераций | Поддержка LCM/Lightning, резкий результат |
| EpicRealism | SD 1.5 / SDXL | 4-8 GB | Тонких деталей, естественного света | Избегает чрезмерной резкости, живые оттенки |
RealVisXL V5.0 остаётся главным выбором сообщества для портретов: кожа сохраняет убедительность при близком рассмотрении, а зернистая структура напоминает плёнку 35mm. Juggernaut XL v10 — самый универсальный checkpoint SDXL. Если не знаете, с чего начать, он одинаково уверенно работает с портретами и предметной съёмкой и уже набрал более 18 миллионов загрузок.
Realistic Vision V6.0 — легенда SD 1.5, которая не собирается уходить: она работает даже на скромной видеокарте с 4 GB и при этом даёт оттенки кожи и свет, сопоставимые с моделями SDXL на меньшем разрешении. CyberRealistic XL предлагает варианты LCM и Lightning для быстрых итераций без потери фотореализма. EpicRealism завершает список намеренно приземлённым подходом и избегает чрезмерной резкости, из-за которой другие модели выглядят слишком «AI-полированными».
Как выбрать модель под своё железо
Выбор модели бессмыслен, если GPU не может её запустить. Практический принцип прост: сначала сопоставьте объём VRAM с правильной архитектурой, затем оптимизируйте реализм внутри этого уровня.
| Уровень VRAM | Рекомендуемая архитектура | Лучшая реалистичная модель | Что ожидать |
|---|---|---|---|
| 4-6 GB | SD 1.5 | Realistic Vision V6.0 | Нативные 512x512, быстрая генерация, отличные оттенки кожи, ограниченное разрешение |
| 8 GB | SDXL | Juggernaut XL v10 или RealVisXL V5.0 | Нативные 1024x1024, высокая детализация, при стеке LoRA может потребоваться управление VRAM |
| 12 GB+ | SDXL без ограничений или Flux | Любой checkpoint SDXL с полным стеком LoRA | Multi-LoRA workflow, ControlNet, ADetailer одновременно |
| 16 GB+ | Flux или SDXL | Flux Dev GGUF Q8 | Лучший доступный локальный фотореализм, превосходные анатомия и следование prompt |
SDXL нужно 8 GB только для загрузки и 12 GB для работы без постоянного жонглирования VRAM. Если у вас 6 GB или меньше, не пытайтесь его форсировать. Модели SD 1.5 вроде Realistic Vision оптимизированы под небольшой объём памяти и всё ещё дают отличный фотореализм в 512x512, после чего изображение можно увеличить. Переход с SD 1.5 на SDXL сразу заметен в анатомии, детализации и понимании prompt, но затраты VRAM растут столь же заметно.
Основные настройки для фотореалистичного результата
Правильный checkpoint — только первый шаг. Именно sampler, CFG, число шагов и negative prompt определяют, будет ли результат похож на фотографию или на рендер.
Sampler. DPM++ 2M SDE Karras и DPM++ 3M SDE Karras считаются сообществом лучшими вариантами для текстуры кожи. Они сохраняют высокочастотные детали: микрошум, который превращается в поры, зерно и неровности поверхности. Euler a и DDIM обычно дают более гладкий результат, то есть прямо противоположный нужному для фотореализма.
CFG. Для портретов SDXL наиболее естественная кожа получается при CFG от 4 до 7. Значения выше 7 направляют модель к идеализированному, чрезмерно чистому результату. Некоторые практики получают отличные результаты при CFG 2-3 и тщательно настроенных negative prompts: модель получает больше свободы для естественной текстуры, но хуже следует prompt.
Steps. Стандартный диапазон для SDXL — 25-30 шагов. Для максимальной детализации кожи 40-60 шагов с DPM++ 3M SDE Karras дают заметное улучшение пор и прорисовки волос. После 60 шагов отдача резко снижается. Варианты Lightning и LCM могут выдавать рабочий результат за 4-8 шагов, но лучше подходят для итераций, а не для финала.
Negative prompts. Именно здесь устраняется большая часть пластикового вида. Сильный negative prompt для реалистичного портрета включает:
plastic, smooth skin, airbrushed, poreless, doll-like, flawless, perfect skin3d render, cgi, digital painting, illustration, cartoon, animeblurry, low quality, deformed, bad anatomy, extra fingers, mutated handswax, retouched, photoshop, overexposed
Первая строка напрямую атакует пластиковый вид. Вторая убирает нефотографические стили. Третья исправляет структурные ошибки. Четвёртая исключает чрезмерно отполированную постобработку, из-за которой изображение выглядит искусственным даже при хорошем основном результате.

Больше, чем просто чекпойнт: LoRA, ADetailer и работа с промптами
Даже с подходящей моделью и настройками лица часто теряют детали на стандартном разрешении. Сообщество разработало многоуровневый подход к постобработке, который системно решает эту проблему.
LoRA для реализма. Лёгкие LoRA вроде Skin & Hand от Polyhedron и add-details-xl добавляют текстуру кожи и мелкие детали при небольших весах от 0.3 до 0.8. При весе 1.0 add-details-xl заставляет модель прорисовывать высокочастотные детали по всему изображению. Для кожи это может быть преобразующим, но на фоне способно породить артефакты. Начните с 0.5 и корректируйте по результату.
ADetailer (After Detailer). Это самый эффективный инструмент для исправления лиц. ADetailer запускает на готовом изображении модель обнаружения, находит лица и автоматически перегенерирует их в более высоком разрешении с отдельным prompt. Рекомендуемая конфигурация:
- Detection model:
face_yolov8n.pt - Confidence threshold: 0.3
- Denoising strength: 0.22-0.28, ниже стандартного, поскольку нужна доработка, а не замена
- Steps: 18-22
- CFG: 4-4.5
- Inpaint only masked: ON
- ADetailer prompt:
natural skin texture, visible pores, subtle imperfections, soft skin transitions, realistic eyes, natural lips
Низкая сила удаления шума критически важна. При 0.5+ ADetailer фактически заменяет лицо, что может добавить артефакты или разрушить идентичность персонажа. При 0.22-0.28 он дорабатывает существующие детали: добавляет структуру пор, делает глаза резче и исправляет небольшие анатомические ошибки, не отбрасывая исходную генерацию.
Приёмы prompt для реализма. Использованные слова формируют текстуру, которую создаёт модель. Эффективные триггеры реализма:
natural skin texture, visible pores, subtle blemishes, frecklescandid iphone camera portrait, raw photo, unretouched85mm portrait lens, shallow depth of field, natural lightingoily skin, sun-damaged skin, aged 35 years old, flyaway hair strands
Последняя строка кажется неожиданной, но она очень эффективна. У настоящих людей бывает жирная кожа, солнечные повреждения, пигментные пятна и выбившиеся волосы. Запрос таких несовершенств уводит модель от идеализированного шаблона к убедительному фотореализму. Указание объектива и схемы света также закрепляет результат в фотографической реальности, а не в цифровом рендере.
Когда локальная установка невозможна: облачные альтернативы
Локальный Stable Diffusion требует серьёзного железа. Для workflow SDXL с LoRA, ADetailer и ControlNet одновременно нужно 12-16 GB VRAM. Полноточный workflow Flux требует 24 GB. Не у всех есть такой компьютер и желание вкладываться в него, а сама настройка — от установки ComfyUI или AUTOMATIC1111 до скачивания многогигабайтных checkpoint и конфигурации sampler и расширений — может занять часы ещё до первой картинки.
Здесь практичной альтернативой становятся облачные AI-сервисы генерации изображений. Платформа Seavid AI для text-to-image даёт доступ к нескольким современным моделям, включая Seedream 5.0, Nano Banana Pro и GPT Image, через браузер без локальной установки. Опишите замысел текстовым prompt, выберите стиль и разрешение — и быстро получите результат. Если нужно улучшить или преобразовать готовую картинку, инструмент image-to-image переносит стиль и улучшает изображение, сохраняя композицию, а SeedEdit позволяет редактировать его инструкциями с сохранением идентичности.
Компромисс — в уровне контроля. Локальный Stable Diffusion предоставляет доступ к каждому параметру: sampler, CFG, числу шагов, весам LoRA, negative prompts и маскам inpainting. Облачные сервисы прячут эти решения за более простым интерфейсом: это удобно для скорости и доступности, но ограничивает точную настройку текстуры кожи или деталей лица. Для быстрых прототипов, контента для соцсетей и пользователей без отдельного GPU облачный путь полностью снимает аппаратный барьер. Но для производственных фотореалистичных портретов, где важна каждая пора, локальный workflow всё ещё сильнее.
Частые ошибки и способы их избежать
- Использование базовой SDXL для портретов. У базовой SDXL хорошо известна склонность к пластиковой коже. Для портретов всегда переходите на дообученный реалистичный checkpoint вроде RealVisXL или Juggernaut XL.
- CFG выше 7 для кожи. Высокий CFG подавляет естественную текстуру. Снизьте его до 4-6 и поручите контроль качества negative prompt.
- Пропуск ADetailer. Лица, созданные в 1024x1024, теряют детали, когда персонаж занимает небольшую часть кадра. ADetailer исправляет это автоматически, поэтому пропускать его незачем.
- Слишком много LoRA в стеке. Каждая добавленная LoRA повышает вероятность цветовых сдвигов и артефактов. Начните с одной LoRA для реализма с весом 0.5, протестируйте и добавляйте следующую только при необходимости.
- Забытые несовершенства. Если prompt говорит только «красивая женщина, идеальная кожа», модель именно это и выдаст — и результат будет фальшивым. Добавьте поры, пятна и признаки естественного света.
- Апскейл без Hi-Res Fix. Обычный апскейл равномерно повышает резкость всего изображения, из-за чего кожа может стать восковой. Используйте Hi-Res Fix с низкой силой удаления шума 0.3-0.4 для контролируемого усиления деталей.
Часто задаваемые вопросы
Можно ли получить фотореалистичный результат на SD 1.5 или обязательно нужен SDXL?
Да. Realistic Vision V6.0 на SD 1.5 по-прежнему отлично передаёт оттенки кожи и реалистичность света. Компромисс — разрешение: нативные 512x512 против 1024x1024 у SDXL, а также стабильность анатомии. Если у GPU 4-6 GB VRAM, SD 1.5 — лучший вариант, а результат затем можно увеличить.
Какое одно изменение лучше всего убирает пластиковый вид?
Добавьте negative prompt, которая явно на него нацелена: plastic, smooth skin, airbrushed, poreless, doll-like, flawless. Уже это заметно улучшает большинство реалистичных checkpoint ещё до настройки sampler или CFG.
Нужен ли отдельный GPU или можно использовать облачные сервисы?
Для локального SDXL рекомендуется выделенная NVIDIA GPU минимум с 8 GB VRAM. Если её нет, облачные сервисы вроде Seavid AI дают доступ к качественным моделям через браузер, хотя контроль параметров будет меньше, чем при локальной установке.
Что лучше для фотореализма: Stable Diffusion или Flux?
Flux обычно даёт более качественный фотореализм, лучшую анатомию и точнее следует prompt, но даже в квантованном виде требует 12+ GB VRAM и имеет меньшую экосистему LoRA. SDXL остаётся практичным выбором для большинства благодаря огромной библиотеке моделей сообщества, зрелым инструментам и более низким требованиям к железу. Для лучшего результата на мощном компьютере Flux Dev в GGUF Q8 сейчас является главным локальным вариантом.
Насколько важен выбор sampler для реалистичности кожи?
Очень важен. DPM++ 2M SDE Karras и DPM++ 3M SDE Karras сохраняют высокочастотный шум, который превращается в текстуру кожи. Переход с Euler a на DPM++ SDE Karras может дать более заметное улучшение реалистичности кожи, чем смена модели, особенно у checkpoint SDXL.



