Qwen3
Открытые модели Alibaba стали для многих дефолтным выбором локального инференса, но вопросов меньше не становится. Здесь выясняют, влезет ли Qwen3.6 35B MoE в одну карту на 24 ГБ, даёт ли MTP в Ollama 0.24 обещанное удвоение скорости и тянет ли Ryzen AI Max+ 395 со 128 ГБ памяти модели за 200B без серверного бюджета. Концентрат практики для тех, кто гоняет нейросети на своём железе, а не в облаке.
3 тем, 16 ответов, 181 просмотров · все теги
- Темы
-
- Qwen3.6 35B MoE на одной 24GB карте — у кого получилось нормально запустить?
в «Локальные LLM и open-source модели» · 7 ответов · 69 просмотров · 09 июн 2026, 20:02
-
- Ryzen AI Max+ 395 со 128 ГБ — реально дешёвый инференс на 200B+ или красивый маркетинг?
в «Локальные LLM и open-source модели» · 4 ответов · 62 просмотров · 09 июн 2026, 18:41
-
- Ollama 0.24 + Qwen3.6 MTP: реально ли ~2x скорости на домашней карте?
в «Локальные LLM и open-source модели» · 5 ответов · 50 просмотров · 08 июн 2026, 16:39