Z-Image Turbo против Flux.2 на 3060 12 ГБ: десять секунд против трёх минут — и в чём подвох
Рейтинг: 48.7% · 7 голосов
Войдите, чтобы голосовать
Голосовать «За» и «Против» могут только авторизованные пользователи. Войдите в свой аккаунт — или зарегистрируйтесь, это займёт минуту.
Нет аккаунта? Зарегистрироваться
Z-Image Turbo против Flux.2 на 3060 12 ГБ: десять секунд против трёх минут — и в чём подвох
Прогнал лоб в лоб Z-Image Turbo и Flux.2-dev на своей 3060 12 ГБ (народная карта, на вторичке сейчас 22-25 тысяч). Контекст: рисую карточки и баннеры для маркетплейсов, нужен фотореализм и хоть какой-то текст на картинке.
Z-Image Turbo, fp8 (около 7 ГБ): 1024 на 1024, 8 шагов, cfg 1 — стабильные 10-12 секунд на картинку после прогрева. Влезает в VRAM целиком вместе с энкодером, комфи даже не свопится. Фотореализм неприлично хорош для 6B: кожа, ткани, еда — на уровне моделей втрое тяжелее. Слабые места: многообъектные сцены путает, мелкий текст мылит, кириллицу рисует через раз.
Flux.2-dev: тут грустнее. Сама DiT на 32B даже в Q3_K_M GGUF в 12 ГБ не лезет, плюс текстовый энкодер на базе Mistral Small — его тоже квантовать. С офлоадом в RAM картинка занимает 2.5-3 минуты, и это при 64 ГБ ОЗУ. Зато следование промпту — другая лига: сцену из шести объектов с заданными цветами и расположением собирает с первого-второго раза, где Z-Image надо черри-пикать из десятка.
Итог для себя: 90% генераций — Z-Image, Flux.2 достаю, когда нужна сложная композиция и есть время на чай. Но, может, я что-то упускаю по оптимизации? Кто как живёт на 12 гигах в 2026?
Z-Image Turbo, fp8 (около 7 ГБ): 1024 на 1024, 8 шагов, cfg 1 — стабильные 10-12 секунд на картинку после прогрева. Влезает в VRAM целиком вместе с энкодером, комфи даже не свопится. Фотореализм неприлично хорош для 6B: кожа, ткани, еда — на уровне моделей втрое тяжелее. Слабые места: многообъектные сцены путает, мелкий текст мылит, кириллицу рисует через раз.
Flux.2-dev: тут грустнее. Сама DiT на 32B даже в Q3_K_M GGUF в 12 ГБ не лезет, плюс текстовый энкодер на базе Mistral Small — его тоже квантовать. С офлоадом в RAM картинка занимает 2.5-3 минуты, и это при 64 ГБ ОЗУ. Зато следование промпту — другая лига: сцену из шести объектов с заданными цветами и расположением собирает с первого-второго раза, где Z-Image надо черри-пикать из десятка.
Итог для себя: 90% генераций — Z-Image, Flux.2 достаю, когда нужна сложная композиция и есть время на чай. Но, может, я что-то упускаю по оптимизации? Кто как живёт на 12 гигах в 2026?
✔ Лучший ответ сформирован автоматически — kernelpilot
Делаю карточки для Ozon и WB на потоке, поэтому встряну с занудством: для коммерции главный вопрос не «какая модель красивее», а «не отличается ли картинка от товара». У нас был кейс: переделали фоны на сгенерированные, CTR карточек заметно вырос, а следом поползли возвраты — модель чуть «улучшила» оттенок ткани, и покупатели получали не то, что видели. Маркетплейсы за систематическое…
Re: Z-Image Turbo против Flux.2 на 3060 12 ГБ: десять секунд против трёх минут — и в чём подвох
@m3power, Упускаешь третьего игрока. Qwen-Image в int4 через Nunchaku — вот золотая середина для 12 ГБ: следование промпту близко к Flux.2, а с SVDQuant-квантом и нодой ComfyUI-nunchaku укладывается секунд в 25-30 на твоей карте. И главное для маркетплейсных задач: текст, включая кириллицу, она рисует лучше всех в опенсорсе — «СКИДКА 40%» на баннере выходит без артефактов, проверено на сотнях генераций.
Flux.2 на 12 ГБ даже в int4 — мазохизм, там одна DiT под 17 гигов.
Flux.2 на 12 ГБ даже в int4 — мазохизм, там одна DiT под 17 гигов.
- kernelpilot
- Сообщения: 24
- Зарегистрирован: 19 май 2026, 15:38
Re: Z-Image Turbo против Flux.2 на 3060 12 ГБ: десять секунд против трёх минут — и в чём подвох
✔ Лучший ответ — сформирован автоматически
Делаю карточки для Ozon и WB на потоке, поэтому встряну с занудством: для коммерции главный вопрос не «какая модель красивее», а «не отличается ли картинка от товара». У нас был кейс: переделали фоны на сгенерированные, CTR карточек заметно вырос, а следом поползли возвраты — модель чуть «улучшила» оттенок ткани, и покупатели получали не то, что видели. Маркетплейсы за систематическое несоответствие наказывают.
Поэтому рабочий пайплайн — не txt2img, а редактирование живого фото: Qwen-Image-Edit как основной инструмент (фон, сцена, свет меняются, товар пиксельно тот же), Flux.2 с мультиреференсом — когда надо выдержать фирменный стиль серии карточек. Чистый txt2img остаётся для баннеров и декора, где товара в кадре нет.
И да, скорость Z-Image подкупает, но в edit-сценариях ей пока ответить нечем.
Поэтому рабочий пайплайн — не txt2img, а редактирование живого фото: Qwen-Image-Edit как основной инструмент (фон, сцена, свет меняются, товар пиксельно тот же), Flux.2 с мультиреференсом — когда надо выдержать фирменный стиль серии карточек. Чистый txt2img остаётся для баннеров и декора, где товара в кадре нет.
И да, скорость Z-Image подкупает, но в edit-сценариях ей пока ответить нечем.
- sleepypanic
- Сообщения: 71
- Зарегистрирован: 11 май 2026, 01:26
Re: Z-Image Turbo против Flux.2 на 3060 12 ГБ: десять секунд против трёх минут — и в чём подвох
Под стилизацию и персонажей всё ещё никто не убил SDXL и Illustrious с лорами — экосистема на Civitai за эти годы такая, что любой стиль натренирован до тебя. Для Z-Image тренеры лор уже подъехали (ai-toolkit и musubi умеют), на 12 ГБ тренится rank 16 часа за три-четыре на полусотне картинок. Но датасет, как обычно, решает сильнее модели.
Re: Z-Image Turbo против Flux.2 на 3060 12 ГБ: десять секунд против трёх минут — и в чём подвох
@hogan20, Добавлю про ОЗУ, об это разбиваются все гайды «Flux.2 на бюджетке»: с GGUF-офлоадом пиково уходит за 40 гигов системной памяти. На моих 32 ГБ начинается своп, и три минуты превращаются в семь. Честный минимум для Flux.2 на 12-гиговой карте — 64 ГБ ОЗУ, закладывайте в бюджет апгрейда сразу.
Re: Z-Image Turbo против Flux.2 на 3060 12 ГБ: десять секунд против трёх минут — и в чём подвох
Я вопрос закрыл гибридом: черновики и перебор идей — локально на Z-Image, бесплатно и быстро, а финалки сложных сцен — арендованная 4090 почасово, выходит 70-90 рублей в час. За вечер нагенерил батчи — и погасил машину. Дешевле, чем тащить 4090 домой ради пары сессий в неделю, при наших ценах на карты так точно.
Поделиться темой:
✈ Telegram
VK
- Похожие темы
-
-
-
-
-
- Запрос с JOIN тормозит на 5 секунд, EXPLAIN внутри — помогите разобраться
10 ответов · 718 просмотров
-
Кто сейчас на конференции
Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость