LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Рейтинг: 61% · 6 голосов
Генеративный AI для картинок и видео: Stable Diffusion, Midjourney, Flux, Sora, ComfyUI, LoRA, ControlNet, промпт-инжиниринг и творческие пайплайны.
Ответить
Аватара пользователя
Vthors22
Сообщения: 35
Зарегистрирован: 14 май 2026, 20:13

LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Сообщение Vthors22 »

Тренирую LoRA на Flux.1 dev через AI Toolkit (Ostris). Датасет — 25 фото одного человека, разные ракурсы, хорошее освещение, обрезал по стандарту 1024x1024. После обучения 2000 шагов при lr=1e-4 — лицо узнаваемо, но всё изображение становится мыльным, теряется текстура кожи и детали фона. При увеличении lr до 3e-4 — лицо плывёт. Что не так?
👍1 ❤️ 🔥 😄 🤔
✔ Лучший ответ сформирован автоматически — rburr
Прежде чем крутить тренировку — проверь, чем генеришь. Часто мыло рождается не в обучении, а на инференсе: Flux dev любит guidance около 3.5 и 20-28 шагов, на 10-12 шагах кожа сразу плывёт в пластик. И отдельно глянь исходники: если 25 фото уже мягкие после ресайза в 1024 (особенно если кропал на телефоне, а не ресайзил Lanczos) — модель честно выучит эту мягкость как часть личности. Открой…
Перейти к ответу →
Аватара пользователя
cudaandy
Сообщения: 10
Зарегистрирован: 28 май 2026, 11:15

Re: LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Сообщение cudaandy »

@Vthors22, Классика. Проблема скорее всего в learning rate scheduler и количестве шагов. Для Flux рекомендую: lr=1e-4, linear warmup первые 100 шагов, cosine decay до конца. И 2000 шагов для 25 картинок — многовато, попробуй 1200-1500. Переобучение на Flux выглядит именно так: лицо запоминается, но модель «забывает» как рисовать всё остальное.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
ansible777
Сообщения: 46
Зарегистрирован: 11 май 2026, 10:14

Re: LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Сообщение ansible777 »

@Vthors22, У меня похожая ситуация решилась через network_dim и network_alpha. Пробовал dim=16/alpha=8 — мыло. Поднял до dim=32/alpha=16 — резкость вернулась. Логика такая: маленький ранг не даёт достаточно параметров чтобы запомнить детали, модель компенсирует усреднением. Flux более требователен к рангу чем SDXL.
👍 ❤️1 🔥2 😄 🤔
Аватара пользователя
schokkjunior
Сообщения: 8
Зарегистрирован: 25 май 2026, 15:58

Re: LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Сообщение schokkjunior »

Добавлю про датасет: 25 фото — нижняя граница. Лучше 40-60, и важно разнообразие не только ракурсов, но и выражений лица, условий освещения. Если все фото студийные с одним светом — модель запомнит именно этот свет как часть идентичности и на других сценах будет плохо работать. Также caption каждой картинки должен описывать именно то что на ней, не шаблонный.
👍1 ❤️ 🔥1 😄 🤔
Аватара пользователя
davkar
Сообщения: 58
Зарегистрирован: 11 май 2026, 03:00

Re: LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Сообщение davkar »

Попробуй DoRA вместо обычной LoRA — в AI Toolkit это параметр use_dora: true в конфиге. На Flux даёт заметно лучшее сохранение деталей при той же размерности сети. Минус — обучение процентов на 20 дольше и checkpoint весит больше.
👍4 ❤️ 🔥 😄 🤔
Аватара пользователя
pandas4
Сообщения: 36
Зарегистрирован: 15 май 2026, 08:41

Re: LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Сообщение pandas4 »

@ansible777, Важный момент который все упускают: после обучения тестируй LoRA с разными весами (0.6, 0.8, 1.0). Вес 1.0 часто даёт переобученный вид, а 0.7-0.8 — оптимальный баланс между похожестью и качеством картинки. В ComfyUI это параметр strength_model в ноде LoraLoader.
👍1 ❤️1 🔥 😄1 🤔
Аватара пользователя
k8s_master
Сообщения: 44
Зарегистрирован: 11 май 2026, 19:55

Re: LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Сообщение k8s_master »

Ещё один лайфхак: финальный checkpoint не всегда лучший. AI Toolkit сохраняет промежуточные каждые N шагов — сравни шаги 800, 1200, 1600, 2000. Часто оптимум где-то в середине, а не в конце обучения.
👍3 ❤️1 🔥 😄 🤔
Аватара пользователя
rburr
Сообщения: 77
Зарегистрирован: 12 май 2026, 17:53

Re: LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Сообщение rburr »

✔ Лучший ответ — сформирован автоматически
Прежде чем крутить тренировку — проверь, чем генеришь. Часто мыло рождается не в обучении, а на инференсе: Flux dev любит guidance около 3.5 и 20-28 шагов, на 10-12 шагах кожа сразу плывёт в пластик. И отдельно глянь исходники: если 25 фото уже мягкие после ресайза в 1024 (особенно если кропал на телефоне, а не ресайзил Lanczos) — модель честно выучит эту мягкость как часть личности. Открой кропы на 100% и убедись, что в них вообще есть микротекстура кожи, прежде чем винить lr.
👍1 ❤️ 🔥 😄1 🤔
Аватара пользователя
barbs
Сообщения: 50
Зарегистрирован: 19 май 2026, 04:16

Re: LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Сообщение barbs »

@schokkjunior, про caption важное уточнение именно под Flux: он ест T5, поэтому работают развёрнутые описания обычным языком, а не booru-теги через запятую как в SDXL. 'a man with short dark hair, slight smile, sitting by a window in soft daylight' заходит лучше, чем 'man, short hair, smile, window'. И всё, что меняется между кадрами — фон, позу, свет — надо обязательно прописывать, иначе модель приклеит это к идентичности и потом будет тащить тот самый студийный свет везде.
👍1 ❤️1 🔥1 😄1 🤔
Аватара пользователя
tor2000
Сообщения: 14
Зарегистрирован: 11 май 2026, 18:37

Re: LoRA для Flux — почему тренировка выходит мыльной, хотя датасет нормальный?

Сообщение tor2000 »

@davkar, DoRA на Flux реально вытягивает детали, но я бы не бежал к ней первым шагом. Если мыло при dim=16 и 2000 шагов — это сначала лечится рангом и сокращением шагов, как выше написали. DoRA добивает последние проценты, а на кривом базовом конфиге она просто дольше будет воспроизводить ту же проблему. Сначала dim=32 и 1200-1500 шагов, и только потом смотреть, нужна ли она вообще.
👍 ❤️ 🔥3 😄 🤔
Ответить
Поделиться темой: ✈ Telegram VK

Вернуться в «Нейрогенерация: изображения и видео»

Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость