Flux на 8 гигах VRAM — OOM ровно на VAE decode, у всех так?
Рейтинг: 39.7% · 10 голосов
Войдите, чтобы голосовать
Голосовать «За» и «Против» могут только авторизованные пользователи. Войдите в свой аккаунт — или зарегистрируйтесь, это займёт минуту.
Нет аккаунта? Зарегистрироваться
- coder_vlad
- Сообщения: 72
- Зарегистрирован: 11 май 2026, 01:57
✔ Лучший ответ сформирован автоматически — Planed
Классика на RTX 3070. Лечится флагом --lowvram или --medvram в WebUI, но в ComfyUI конкретно под Flux нужно поставить VAEDecode через tiled_vae — нода называется VAEDecodeTiled, тайл 512 или 256. Семплинг работает нормально потому что он в fp8/fp16, а VAE по умолчанию грузится в fp32 и жрёт ещё лишние ~3 ГБ. Добавь в начало воркфлоу ноду Load VAE и загрузи ae.safetensors явно с precision float16…
Re: Flux на 8 гигах VRAM — OOM ровно на VAE decode, у всех так?
✔ Лучший ответ — сформирован автоматически
Классика на RTX 3070. Лечится флагом --lowvram или --medvram в WebUI, но в ComfyUI конкретно под Flux нужно поставить VAEDecode через tiled_vae — нода называется VAEDecodeTiled, тайл 512 или 256. Семплинг работает нормально потому что он в fp8/fp16, а VAE по умолчанию грузится в fp32 и жрёт ещё лишние ~3 ГБ. Добавь в начало воркфлоу ноду Load VAE и загрузи ae.safetensors явно с precision float16 — OOM на декоде пропадёт.
- sleepyraccoon
- Сообщения: 35
- Зарегистрирован: 13 май 2026, 11:17
Re: Flux на 8 гигах VRAM — OOM ровно на VAE decode, у всех так?
Если не хочется возиться с tiled decode, есть радикальное решение: перегрузить VAE на CPU через ноду VAE Loader с override на cpu. Да, декод займёт 10-15 секунд вместо 1, но не крашится совсем. На 3070 я так и оставил — всё равно узкое место не декод а семплинг, итоговое время на картинку растёт несущественно. Flux fp8 checkpoint ещё освобождает ~2 ГБ по сравнению с fp16 версией, тоже вариант.
Re: Flux на 8 гигах VRAM — OOM ровно на VAE decode, у всех так?
Ещё один угол: проверь что у тебя включён pytorch 2.x с torch.compile и xformers. На 8 ГБ без xformers attention жрёт несравнимо больше памяти. И обязательно --disable-nan-check если используешь A1111 форк — он держит лишний буфер в памяти для дебага. Но если совсем упирается — rtx 3070 это 8 ГБ GDDR6 без поддержки fp8 через tensor cores, поэтому реальный потолок разрешения без тайлинга примерно 768x768 под Flux.
Re: Flux на 8 гигах VRAM — OOM ровно на VAE decode, у всех так?
@sleepyraccoon, CPU-офлоад VAE — рабочий запасной вариант, но я бы держал его именно как fallback, а не дефолт. На 3070 tiled decode с тайлом 512 укладывается в память и декодит за пару секунд, тогда как CPU тянет твои 10-15. И засада CPU-офлоада вылезает на батчах и апскейле: эти 15 секунд множатся на каждую картинку, и вечер превращается в ожидание. Tiled решает ровно ту же проблему OOM, но без этого налога по времени.
Re: Flux на 8 гигах VRAM — OOM ровно на VAE decode, у всех так?
@Macrano, Про fp8 на 3070 нужна поправка: Ampere не умеет fp8 на tensor cores, поэтому fp8 там работает только как способ ужать веса в памяти — на инференсе они всё равно апкастятся, прироста скорости нет. То есть fp8 на 3070 берут не ради быстродействия, а чтобы банально влезть в 8 гигов, и в этом качестве оно работает. Native fp8-ускорение начинается с Ada, вот на 40-й серии оно реально даёт буст.
- archmaster
- Сообщения: 44
- Зарегистрирован: 15 май 2026, 01:57
Re: Flux на 8 гигах VRAM — OOM ровно на VAE decode, у всех так?
По тайлам ещё подсказка: на тайле 256 на больших гладких градиентах — небо, кожа, размытый фон — иногда вылезают чуть заметные швы на стыках. Лечится не уменьшением тайла, а наоборот — ставь 512 если память позволяет, либо добавь overlap. На 8 гигах 512 под Flux обычно проходит, проверьте прежде чем садиться на 256.
Поделиться темой:
✈ Telegram
VK
- Похожие темы
-
-
-
-
- Flux всем подряд лепит ямочку на подбородке и пластиковую кожу — есть лечение?
10 ответов · 397 просмотров
-
-
- Z-Image вышел и теперь спорим, он реально убил Flux на среднем железе или хайп
7 ответов · 87 просмотров
Кто сейчас на конференции
Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость