Обучение LoRA на вымышленном персонаже: датасет, Kohya и ComfyUI
Содержание
- Зачем своя LoRA: постоянный вымышленный персонаж
- Жёсткое правило: только сгенерированные вымышленные персонажи, никаких фото реальных людей
- Датасет: 20–40 своих генераций, ракурсы, одежда
- Подписи (captions) и триггер-слово
- Kohya_ss: параметры для SDXL и Flux
- Обучение в ComfyUI и в облаке
- Проверка результата и переобучение
- Типичные ошибки при обучении LoRA
- Если обучать не хочется: персонажи в онлайн-сервисах
- Итоги
- Частые вопросы
Своя LoRA — самый надёжный способ получить постоянного вымышленного персонажа: одну и ту же внешность, причёску и узнаваемые черты в любых сценах, позах и стилях. В этом гайде разбираем обучение LoRA от начала до конца: как собрать датасет из собственных генераций, как написать подписи и выбрать триггер-слово, какие параметры выставить в Kohya_ss для SDXL и Flux, можно ли обучить LoRA в ComfyUI или в облаке бесплатно и как проверить результат. Если вы пока не готовы к обучению, начните с материала как сохранить постоянного ИИ-персонажа без тренировки — паспорт персонажа, seed и встроенные функции сервисов часто закрывают задачу.
Коротко
- Обучаем только вымышленных взрослых персонажей (25+), которых вы сами сгенерировали. Обучение на фото реальных людей — запрещено, без исключений.
- Датасет: 20–40 собственных генераций одного персонажа — разные ракурсы, планы, освещение и одежда.
- У каждой картинки — текстовая подпись и общее триггер-слово, которое потом вызывает персонажа в промте.
- Самый популярный инструмент — Kohya_ss (графический интерфейс к скриптам sd-scripts), поддерживает SD 1.5, SDXL и Flux.1.
- Нет видеокарты — используйте облачные GPU или встроенные функции персонажей в онлайн-сервисах.
Зачем своя LoRA: постоянный вымышленный персонаж
Модели Stable Diffusion и Flux отлично рисуют «какую-нибудь» девушку по описанию, но плохо повторяют одну и ту же. Даже при одинаковом промте меняются форма лица, разрез глаз, пропорции, мелкие детали вроде родинки или шрама. Для одиночных картинок это не проблема, а для серии — комикса, визуальной новеллы, истории в нескольких сценах, аватара ИИ-компаньона — критично.
Есть несколько способов бороться с этим без обучения: подробный «паспорт» персонажа в промте, фиксированный seed, референсы через IP-Adapter, функции вроде AI Character в онлайн-сервисах. Они работают, но у каждого есть предел. Своя LoRA решает задачу глубже: вы буквально учите модель новому понятию — «вот так выглядит моя героиня». После обучения достаточно написать триггер-слово, и модель воспроизводит внешность в любой сцене, от портрета до общего плана.
Коротко о том, что такое LoRA вообще, как её подключать и подбирать вес, — в отдельном гайде LoRA в Stable Diffusion. Здесь — только обучение.
| Способ | Сложность | Стабильность внешности | Когда выбирать |
|---|---|---|---|
| Паспорт персонажа + seed | Низкая | Средняя | Несколько картинок, одна модель |
| Референс (IP-Adapter, функции сервисов) | Средняя | Средняя или высокая | Нужно быстро, без обучения |
| Своя LoRA | Высокая | Высокая | Длинная серия, много сцен и стилей |
Жёсткое правило: только сгенерированные вымышленные персонажи, никаких фото реальных людей
Главное правило этого гайда
Обучать LoRA можно только на изображениях вымышленного персонажа, которого вы сами сгенерировали. Обучение на фотографиях реальных людей — знакомых, бывших партнёров, блогеров, актёров, моделей, кого угодно — запрещено. Это нарушает правила всех площадок, право человека на собственное изображение (ст. 152.1 ГК РФ) и может повлечь уголовную ответственность. Персонаж должен быть явно взрослым: в промтах датасета указывайте возраст 25+ и взрослые пропорции. Никаких лиц младше 18 лет — ни реальных, ни вымышленных.
Почему правило такое жёсткое. LoRA, обученная на фото конкретного человека, позволяет генерировать его в любых сценах без его согласия. Именно поэтому крупные площадки удаляют такие модели, а правила генераторов 18+ прямо запрещают использование чужой внешности. Мы не даём инструкций для такой работы и не рекомендуем сервисы, которые её допускают. Подробнее о правовой стороне — в статье законно ли создавать ИИ-контент 18+.
Практическое следствие для датасета: не используйте чужие фото даже «для лица», даже частично, даже в смеси с генерациями. Не берите картинки из чужих галерей и соцсетей. Всё, что попадает в обучение, — ваши собственные генерации вымышленного взрослого персонажа.
Датасет: 20–40 своих генераций, ракурсы, одежда
Качество LoRA на 80% определяется датасетом. Параметры обучения можно подобрать за пару попыток, а плохой набор картинок никакие настройки не спасут.
Шаг 1. Придумайте и зафиксируйте персонажа
Начните с текстового описания: возраст (например, 27 лет), телосложение, цвет и длина волос, форма лица, цвет глаз, отличительные черты. Сгенерируйте несколько десятков вариантов в любимой модели и выберите тот, который нравится. Затем ищите в генерациях этого же человека: фиксируйте seed, используйте один и тот же подробный промт, при необходимости доводите лицо через inpaint. Задача — набрать картинки, где героиня узнаваема.
Шаг 2. Разнообразие — ключ к гибкости
Если все картинки одинаковые, LoRA выучит не персонажа, а конкретную позу, фон и одежду. Нужно, чтобы менялось всё, кроме внешности:
- Ракурсы: анфас, три четверти, профиль, вид чуть сверху и снизу.
- Планы: примерно треть крупных портретов, треть по пояс, треть в полный рост.
- Одежда: разные наряды, чтобы одежда не «приросла» к персонажу.
- Фон и свет: студия, улица, интерьер, дневной и вечерний свет.
- Эмоции: нейтральное лицо, улыбка, серьёзное выражение.
Шаг 3. Отбор и подготовка
Для персонажа обычно хватает 20–40 изображений; это ориентир из практики сообщества, а не жёсткое правило. Лучше 25 отличных картинок, чем 60 средних: каждый слабый кадр тянет качество всей LoRA вниз. Удаляйте кадры с лишними пальцами, искажёнными глазами и артефактами — модель их тоже выучит. Разрешение — не ниже базового для модели: 1024 пикселей по короткой стороне для SDXL и Flux, 512–768 для SD 1.5. Обрезать все картинки до квадрата при этом совсем не обязательно: Kohya поддерживает бакеты с разными пропорциями.
| Тип кадра | Доля в датасете | Зачем |
|---|---|---|
| Крупный портрет | Около трети | Детали лица и глаз |
| По пояс | Около трети | Причёска, плечи, пропорции |
| Полный рост | Около трети | Фигура, чтобы лицо не «ломалось» на общих планах |
Подписи (captions) и триггер-слово
Каждой картинке в датасете нужна текстовая подпись в файле с тем же именем и расширением .txt: image01.png и image01.txt. Подпись объясняет модели, что изображено, и помогает отделить персонажа от остального.
Триггер-слово
Выберите короткое уникальное слово, которого нет в обычном словаре модели, например «nrgl_mira». Оно ставится в начало каждой подписи. После обучения именно это слово вызывает вашего персонажа. Не используйте имена знаменитостей и существующих персонажей — это и путает модель, и нарушает правило о реальных людях.
Что писать в подписи
Главный принцип: описывайте то, что должно меняться, и не описывайте то, что должно стать частью персонажа. Если в подписи есть «red dress, city street», модель поймёт, что платье и улица — отдельные понятия, и не будет их навязывать. Если постоянную черту (например, цвет глаз) описывать не стоит, чтобы она «впиталась» в триггер-слово.
Пример подписи для SDXL-модели в стиле тегов:
nrgl_mira, 1woman, adult woman, 27 years old, solo, upper body, looking at viewer, smile, white shirt, indoors, soft window light
Для Flux лучше работают описания обычными предложениями: «nrgl_mira, an adult woman in her late twenties, standing in a sunlit kitchen, wearing a grey sweater, smiling softly».
Автоматические подписи
Вручную подписывать 30 картинок долго. В Kohya_ss есть вкладка с утилитами для автоматических подписей (теговые модели вроде WD14 и описательные модели). Используйте их как черновик: обязательно пройдитесь по каждому файлу, добавьте триггер-слово, уберите ошибки и лишние теги, закрепите «adult woman» и возраст.
Kohya_ss: параметры для SDXL и Flux
Kohya_ss — графический интерфейс к скриптам sd-scripts. По данным README проекта, он поддерживает обучение LoRA, LoHa, LoKr, Dreambooth, fine-tuning и Textual Inversion для SD 1.5/2.x, SDXL, SD3, Flux.1 и ряда других моделей. Устанавливается на Windows и Linux через uv или pip по инструкциям из репозитория; на macOS работа не гарантируется. Официальной «портативной» сборки README не описывает: сборки kohya ss portable, которые встречаются в сети, делают сторонние авторы, и проверять их нужно самостоятельно.
Структура папок
Kohya ожидает папку с изображениями, внутри которой есть подпапка вида «10_nrgl_mira woman». Число в начале — количество повторов каждой картинки за эпоху, дальше — триггер-слово и класс. Рядом создайте папки для результатов (output) и логов.
Стартовые параметры для SDXL
Ниже — ориентиры, которые часто встречаются в руководствах сообщества. Это не результат нашего теста: оптимальные значения зависят от модели и датасета, поэтому начинайте с них и корректируйте по результату.
| Параметр | SDXL (ориентир) | Flux.1 (ориентир) | Что делает |
|---|---|---|---|
| Базовая модель | Та, в которой будете генерировать (SDXL, Pony, Illustrious) | Flux.1 dev | LoRA лучше всего работает на своей базе |
| Network rank (dim) | 16–32 | 16–32 | «Ёмкость» LoRA; больше — тяжелее файл и выше риск переобучения |
| Network alpha | Половина rank или равна ему | Половина rank или равна ему | Масштаб обучения |
| Learning rate | Порядка 1e-4 | Порядка 1e-4 или ниже | Скорость обучения |
| Optimizer | AdamW8bit или Prodigy | AdamW8bit | Алгоритм оптимизации |
| Разрешение | 1024 | 1024 (или 512 для экономии памяти) | Размер обучения |
| Эпохи | 8–15, с сохранением каждой | Меньше шагов, чем для SDXL | Сколько раз модель видит датасет |
| Mixed precision | bf16 (если поддерживает карта) | bf16 | Экономия памяти |
Сохраняйте LoRA после каждой эпохи или каждые несколько эпох. Потом вы сравните промежуточные версии и выберете лучшую — чаще всего это не последняя.
Экономия видеопамяти
Обучение SDXL и тем более Flux требует заметно больше памяти, чем генерация. Помогают gradient checkpointing, кеширование латентов и текстовых эмбеддингов на диск, меньший batch size (1–2), fp8-режим базовой модели для Flux. О выборе видеокарты — в нашем гайде по выбору видеокарты для Stable Diffusion.
Сэмплы во время обучения
Kohya умеет генерировать пробные картинки по ходу обучения. Задайте 2–3 промта с триггер-словом в разных сценах — так вы увидите, в какой момент персонаж становится узнаваемым, а в какой начинается переобучение.
Обучение в ComfyUI и в облаке
Обучение LoRA в ComfyUI
Для ComfyUI существуют пользовательские наборы нод для обучения LoRA, в том числе обёртки над теми же sd-scripts. Схема работы та же: нода загрузки датасета, параметры сети, запуск обучения, сохранение файла. Плюс — всё в одном интерфейсе, где вы потом генерируете. Минус — такие расширения развиваются быстрее документации, настройки иногда меняются от версии к версии. Если вы только начинаете, Kohya_ss проще: там все параметры собраны на одном экране с подсказками. Основы ComfyUI — в гайде ComfyUI для начинающих.
Облачные GPU
Если своей видеокарты не хватает, Kohya можно запустить на арендованном облачном GPU: README проекта описывает шаблоны для Runpod и Novita, установку через Docker и Colab-блокнот от стороннего автора. Обучение LoRA бесплатно возможно в бесплатном Colab, но доступность GPU там не гарантирована, а правила платформы могут ограничивать отдельные виды контента. Подробнее о вариантах — в статье Stable Diffusion в облаке.
Z-Image Turbo LoRA training
Для новых моделей вроде Z-Image Turbo инструменты обучения LoRA появляются по мере развития экосистемы, и поддержка в разных тренерах может отличаться. Перед стартом проверьте, поддерживает ли выбранная версия тренера нужную архитектуру, и ориентируйтесь на карточку модели и документацию инструмента, а не на пересказы.
Онлайн-тренеры на площадках
Некоторые площадки моделей предлагают обучение LoRA прямо в браузере. Это удобно, но проверьте правила: загружаемый датасет проходит модерацию, а фото реальных людей запрещены. Наше правило действует везде — только ваши генерации вымышленного взрослого персонажа.
Проверка результата и переобучение
Когда обучение закончено, у вас есть несколько файлов .safetensors — по одному на сохранённую эпоху. Скопируйте их в папку LoRA своего интерфейса и сравните.
Как тестировать
- Возьмите 3–4 промта, которых не было в датасете: новая одежда, новая локация, другой план.
- Сгенерируйте их с одинаковым seed для каждой эпохи и веса LoRA 0,7–1,0.
- Сравните: где лицо узнаваемо, а одежда и фон при этом слушаются промта.
Признаки недообучения и переобучения
| Симптом | Диагноз | Что делать |
|---|---|---|
| Персонаж неузнаваем даже при весе 1,0 | Недообучение | Берите более позднюю эпоху, добавьте повторов или шагов |
| Всегда одна и та же поза, одежда или фон | Переобучение или однообразный датасет | Ранняя эпоха, разнообразнее датасет, подробнее подписи |
| Пережжённые цвета, артефакты, «пластиковая» кожа | Переобучение, слишком высокий learning rate | Снизить скорость обучения или вес LoRA |
| Персонаж появляется без триггер-слова | Сильная LoRA | Снизить вес при генерации, взять раннюю эпоху |
Итерации
Первая LoRA редко бывает идеальной, и это нормально даже для опытных авторов: обычно нужно две-три попытки, прежде чем персонаж станет по-настоящему стабильным. Нормальный процесс — сгенерировать с первой версией новые удачные кадры, добавить их в датасет, убрать слабые и обучить второй раз. Каждая итерация делает персонажа стабильнее и гибче. Чтобы лицо на общих планах не терялось, используйте после генерации детейлер: подробнее в гайде ADetailer и inpaint.
Типичные ошибки при обучении LoRA
Большинство неудачных LoRA ломаются на одних и тех же вещах. Проверьте себя по этому списку до запуска, а не после нескольких часов обучения.
- Однообразный датасет. Тридцать портретов анфас на сером фоне дадут LoRA, которая умеет только портрет анфас на сером фоне. Добавьте планы в полный рост, разные сцены и одежду.
- Брак в картинках. Лишние пальцы, «поплывшие» глаза, артефакты на коже модель запоминает так же старательно, как удачные детали. Отбраковывайте жёстко.
- Непоследовательная внешность. Если в половине кадров у героини каре, а в половине длинные волосы, LoRA выучит нечто среднее. Решите, какие черты постоянные, и держите их во всех изображениях.
- Нет триггер-слова или оно слишком общее. Слово вроде «girl» или «woman» конфликтует со словарём модели. Используйте уникальное сочетание букв.
- Обучение не на той базе. LoRA для SDXL не подойдёт к SD 1.5 или Flux. Если генерируете в Pony или Illustrious, обучайте на соответствующей базе.
- Слишком высокий learning rate и много эпох. Результат — пережжённые цвета и персонаж, который «прилипает» к каждой генерации. Начинайте с умеренных значений и сравнивайте эпохи.
- Возраст не закреплён. В подписях и промтах всегда указывайте «adult woman» и возраст 25+, чтобы персонаж оставался явно взрослым в любом стиле, включая аниме.
Отдельный совет: храните датасет, подписи и файл конфигурации Kohya вместе с готовой LoRA. Когда через месяц захочется улучшить персонажа или обучить его под новую базовую модель, вы начнёте не с нуля, а с проверенного набора, и повторите удачный результат.
Если обучать не хочется: персонажи в онлайн-сервисах
Обучение LoRA — это видеокарта, время и несколько попыток. Если вам нужен постоянный вымышленный персонаж без всей этой кухни, у онлайн-генераторов есть встроенные функции. В Promptchan есть функция AI Character для постоянного лица в генерациях, а в Pornworks — раздел персонажей (героев) и шаблоны с LoRA, которые подключаются одним кликом. Правила там такие же: только вымышленные взрослые, никаких реальных людей.
Pornworks
Лучший для генерации по тексту
Изображения, GIF и короткие видео по текстовому описанию
- Генерация изображений по тексту: реализм, аниме, арт
- Видео и анимация по описанию сцены
- Апскейл до 4K и готовые шаблоны промтов
- Можно начать бесплатно, без долгой регистрации
- Лучше всего для
- Картинки и видео с нуля по промту
- Бесплатно
- Есть бесплатный старт (лимит генераций)
- Цена
- Тарифы — в обзоре тарифов
Партнёрская ссылка · 18+ · только генерация с нуля
Персонажи без обучения: открыть Pornworks Партнёрская ссылка · 18+
Promptchan
Лучший для ИИ-компаньонов
ИИ-персонажи, чат-компаньоны и изображения персонажей
- Чат с ИИ-компаньонами и создание своего персонажа
- Генерация изображений персонажа по тексту
- Аниме и фотореалистичные стили, библиотека поз
- Веб, iOS и Android
- Лучше всего для
- ИИ-девушка, чат и истории с персонажем
- Бесплатно
- Бесплатно: ежедневные гемы на картинки и чат
- Цена
- Plus $14.99 · Premium $23.99 · Pro $33.99 в месяц (проверено 30.09.2026)
Партнёрская ссылка · 18+ · только генерация с нуля
Постоянный персонаж без LoRA: попробовать Promptchan Партнёрская ссылка · 18+
Итоги
Своя LoRA — лучший инструмент для постоянного вымышленного персонажа, но её качество определяется датасетом. Соберите 20–40 разнообразных собственных генераций взрослой героини, тщательно подпишите их с уникальным триггер-словом, начните с умеренных параметров Kohya_ss и сохраняйте каждую эпоху. Тестируйте на новых промтах и не бойтесь второй итерации. И помните главное: никаких фото реальных людей — только персонажи, которых вы придумали и сгенерировали сами.
Частые вопросы
Как создать LoRA для Stable Diffusion?
Сгенерируйте 20–40 изображений своего вымышленного взрослого персонажа в разных ракурсах и одежде, подпишите каждое с уникальным триггер-словом и обучите LoRA в Kohya_ss на той же базовой модели, в которой будете генерировать.
Можно ли обучить LoRA на фотографиях реального человека?
Нет. Обучение на фото реальных людей запрещено правилами площадок и нарушает право на изображение. Используйте только собственные генерации вымышленного взрослого персонажа.
Сколько картинок нужно для обучения LoRA?
Для персонажа в сообществе обычно называют 20–40 изображений. Важнее качество и разнообразие: разные ракурсы, планы, одежда и освещение.
Можно ли обучить LoRA бесплатно?
Да, локально на своей видеокарте или в бесплатном Colab, но в Colab доступность GPU не гарантирована. Облачные GPU и онлайн-тренеры обычно платные.
Поддерживает ли Kohya_ss обучение LoRA для Flux?
Да, по данным README проекта Kohya_ss поддерживает Flux.1, а также SD 1.5, SDXL и SD3. Для Flux требуется больше видеопамяти, помогают fp8-режим и кеширование.
Как понять, что LoRA переобучена?
Персонаж всегда в одной позе или одежде, цвета пережжены, появляются артефакты. Возьмите более раннюю эпоху, снизьте learning rate или сделайте датасет разнообразнее.
Можно ли тренировать LoRA в ComfyUI?
Да, через пользовательские наборы нод для обучения. Для первого опыта удобнее Kohya_ss, где все параметры собраны в одном интерфейсе.


