Qwen
Семейство открытых моделей от Alibaba стало дефолтом локального инференса: Qwen2.5-Coder и Qwen3-Coder гоняют вместо платных API, а свежие MoE-версии пытаются уместить в одну карту на 24 ГБ. В треды несут замеры квантизаций Q4_K_M против Q5_K_M, опыт файнтюна через LoRA и расчёты, окупается ли своё железо. Если выбираете локальную модель под код или хотите выжать максимум из 3090 — вам сюда.
20 тем, 156 ответов, 6888 просмотров · все теги
Похожие теги:
MoE 6новые модели 4GPU 3llama.cpp 3QLoRA 3LoRA 2kv cache 2контекст 2unsloth 2файнтюн 2файнтюнинг 2DeepSeek 1cpu инференс 1локальные-модели 1русский язык 1
- Темы
-
- Зафайнтюнил Qwen3 14B на тикетах саппорта и получил лоботомита. Вскрытие фейла
в «Локальные LLM и open-source модели» · 9 ответов · 66 просмотров · 12 июн 2026, 05:32
-
- Файнтюнил Qwen на базе тикетов через QLoRA и получил лоботомита, разбор факапа
в «Локальные LLM и open-source модели» · 4 ответов · 56 просмотров · 11 июн 2026, 02:27
-
- Какая локалка в 2026 реально умеет в русский, а не в кальку с английского?
в «Локальные LLM и open-source модели» · 7 ответов · 72 просмотров · 10 июн 2026, 13:17
-
- Перешёл на локальный Qwen3-Coder вместо API — окупается ли железо реально?
в «AI-ассистированная разработка» · 15 ответов · 689 просмотров · 10 июн 2026, 05:54
-
- Влезет ли 32B модель в 24 ГБ VRAM или я зря купил 3090? ✓ Решено
в «Локальные LLM и open-source модели» · 11 ответов · 1195 просмотров · 09 июн 2026, 22:12
-
- Локальная модель для кода на своём железе — кто что гоняет в 2026?
в «AI-ассистированная разработка» · 10 ответов · 1137 просмотров · 09 июн 2026, 21:48
-
- Q4_K_M против Q5_K_M: реально слышно разницу или это плацебо?
в «Локальные LLM и open-source модели» · 18 ответов · 1430 просмотров · 09 июн 2026, 20:01
-
- Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?
в «Локальные LLM и open-source модели» · 10 ответов · 1082 просмотров · 09 июн 2026, 16:39
-
- LoRA vs полный файнтюн в 2026 — кто-нибудь реально видит разницу в качестве?
в «Машинное обучение и Data Science» · 11 ответов · 640 просмотров · 09 июн 2026, 08:26
-
- Зафайнтюнил Qwen2.5-7B на тикетах саппорта, получил лоботомита. где я облажался
в «Машинное обучение и Data Science» · 6 ответов · 66 просмотров · 08 июн 2026, 15:22
-
- Заявленные 128k контекста это сказки, после 40k модель тупеет на глазах
в «Локальные LLM и open-source модели» · 5 ответов · 48 просмотров · 27 май 2026, 05:37
-
- Qwen3.5-30B-A3B вышел, обещают уровень старшей 235 на агентских задачах
в «Локальные LLM и open-source модели» · 4 ответов · 45 просмотров · 24 май 2026, 23:09
-
- Месяц на qwen3-coder с 4090 вместо Cursor, делюсь итогами
в «AI-ассистированная разработка» · 6 ответов · 54 просмотров · 24 май 2026, 04:35
-
- Вышли веса Qwen3.5-35B-A4B, первые впечатления от квантов
в «Локальные LLM и open-source модели» · 6 ответов · 50 просмотров · 23 май 2026, 19:20
-
- Qwen3.5-35B-A4B вышел, MoE с 4 млрд активных, первые впечатления
в «Локальные LLM и open-source модели» · 5 ответов · 39 просмотров · 23 май 2026, 14:57
-
- Qwen3-235B на 128 гигах RAM, реально выжать больше 5 t/s?
в «Локальные LLM и open-source модели» · 6 ответов · 44 просмотров · 23 май 2026, 09:27
-
- Qwen3.5 вышел, мелкий MoE 42B-A6B выглядит как новый домашний дефолт
в «Локальные LLM и open-source модели» · 5 ответов · 46 просмотров · 20 май 2026, 23:16
-
- Qwen3.5-40B-A4B вышла, apache 2.0. MoE, которая влезает в 32 гига обычной RAM
в «Локальные LLM и open-source модели» · 4 ответов · 30 просмотров · 18 май 2026, 05:37
-
- 256к контекста в карточке модели, а после 60к каша. Кто-нибудь реально пользуется длинным контекстом?
в «Локальные LLM и open-source модели» · 7 ответов · 50 просмотров · 17 май 2026, 07:22
-
- QLoRA на 40к саппорт-тикетов: месяц работы, модель отупела. Где я облажался?
в «Локальные LLM и open-source модели» · 7 ответов · 49 просмотров · 17 май 2026, 05:34