Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Теги: #Qwen
Рейтинг: 37% · 36 голосов
Запуск больших языковых моделей локально: Llama, Mistral, Qwen, DeepSeek, Gemma. Квантизация GGUF, Ollama, llama.cpp, vLLM, LM Studio, выбор GPU и оптимизация инференса.
Аватара пользователя
harringt
Сообщения: 6
Зарегистрирован: 18 май 2026, 21:17

Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Сообщение harringt »

Перепробовал кучу моделей для автодополнения и рефакторинга локально. Qwen2.5-Coder 32B пока лучшее что видел из открытого, реально близко к облачным. У кого другой опыт, есть что-то ещё сильнее?
👍 ❤️ 🔥 😄 🤔
✔ Лучший ответ сформирован автоматически — gdgdgd
@Omoto, связка 7B для инлайна и 32B для чата звучит разумно, но у меня немного другой опыт по железу: на ноуте даже 7B в Q4_K_M при FIM начинает тупить если контекст файла больше 2-3 тысяч токенов — суммарная задержка до первого токена уже заметна в редакторе. Помогает держать 7B в Q2_K или использовать отдельную маленькую модель типа Qwen2.5-Coder 1.5B именно для автокомплита, а 7B уже для…
Перейти к ответу →
Аватара пользователя
delphin
Сообщения: 72
Зарегистрирован: 13 май 2026, 02:35

Re: Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Сообщение delphin »

Согласен, Qwen2.5-Coder 32B на FIM (заполнение посередине) отрабатывает шикарно, в Continue.dev завёл как локальный копайлот. 7B-версия для автокомплита в реалтайме тоже огонь, быстрая и не тупит.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
misha12
Сообщения: 67
Зарегистрирован: 11 май 2026, 04:09

Re: Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Сообщение misha12 »

Для Rust всё ещё иногда галлюцинирует несуществующие методы крейтов, но реже чем остальные. На Python и JS претензий вообще нет. Codestral от Mistral тоже неплох, но Qwen субъективно точнее.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
Omoto
Сообщения: 120
Зарегистрирован: 12 май 2026, 03:05

Re: Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Сообщение Omoto »

Я связку держу: 7B Coder в редакторе для inline-подсказок, 32B дёргаю в чате для разбора сложных кусков и ревью. По железу - 7B на ноуте, 32B на десктопе с 3090. Очень удобно.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
lonelygoblin
Сообщения: 61
Зарегистрирован: 12 май 2026, 12:45

Re: Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Сообщение lonelygoblin »

О, идея с двумя моделями под разные задачи годная. А контекст какой выставляете под анализ больших файлов?
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
roero
Сообщения: 23
Зарегистрирован: 11 май 2026, 05:17

Re: Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Сообщение roero »

Qwen2.5-Coder заявлен до 128к через YaRN, но честно держит хорошо тысяч 32. Дальше начинает терять детали в начале файла. Для одного-двух файлов за глаза, на целый репозиторий лучше RAG прикручивать.
👍1 ❤️2 🔥2 😄1 🤔5
Аватара пользователя
Manuelriere
Сообщения: 58
Зарегистрирован: 13 май 2026, 17:46

Re: Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Сообщение Manuelriere »

Добавлю про SQL - именно Coder-версия заметно лучше базового Instruct в сложных джойнах и оконных функциях. Если работа крутится вокруг баз, берите именно coder-вариант, не обычный чат.
👍1 ❤️ 🔥1 😄 🤔
Аватара пользователя
Omoto
Сообщения: 120
Зарегистрирован: 12 май 2026, 03:05

Re: Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Сообщение Omoto »

Спасибо, ребят. Похоже Qwen2.5-Coder это пока консенсус. Попробую связку 7B+32B как frontend_vasya предложил, звучит как мой сетап.
👍1 ❤️ 🔥 😄 🤔
Аватара пользователя
gdgdgd
Сообщения: 77
Зарегистрирован: 11 май 2026, 03:27

Re: Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Сообщение gdgdgd »

✔ Лучший ответ — сформирован автоматически
@Omoto, связка 7B для инлайна и 32B для чата звучит разумно, но у меня немного другой опыт по железу: на ноуте даже 7B в Q4_K_M при FIM начинает тупить если контекст файла больше 2-3 тысяч токенов — суммарная задержка до первого токена уже заметна в редакторе. Помогает держать 7B в Q2_K или использовать отдельную маленькую модель типа Qwen2.5-Coder 1.5B именно для автокомплита, а 7B уже для chat-сценариев.
👍1 ❤️1 🔥1 😄 🤔
Аватара пользователя
bunmaker
Сообщения: 40
Зарегистрирован: 11 май 2026, 23:26

Re: Лучшая локальная модель под код в 2026 - Qwen2.5-Coder всех уделал?

Сообщение bunmaker »

@misha12, галлюцинации на Rust крейтах у Qwen лечатся частично через system prompt с явным указанием «не выдумывай методы, если не уверен — скажи». Плюс помогает держать в контексте Cargo.toml — модель тогда видит реальный список зависимостей и реже придумывает несуществующее API. Не идеально, но количество галлюцинаций падает ощутимо.
👍1 ❤️1 🔥1 😄 🤔
Ответить
Поделиться темой: ✈ Telegram VK
Похожие запросы: qwen vs llama что лучшекак запустить deepseek локальноmistral для локального запуска отзывылучшая локальная llm для кода

Вернуться в «Локальные LLM и open-source модели»

Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость