DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Теги: #DeepSeek
Рейтинг: 62.5% · 69 голосов
Запуск больших языковых моделей локально: Llama, Mistral, Qwen, DeepSeek, Gemma. Квантизация GGUF, Ollama, llama.cpp, vLLM, LM Studio, выбор GPU и оптимизация инференса.
Аватара пользователя
pharside
Сообщения: 25
Зарегистрирован: 15 май 2026, 18:41

Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение pharside »

✔ Лучший ответ — сформирован автоматически
Ещё момент по выбору дистиллята: R1-Distill-Qwen-32B и R1-Distill-Llama-70B — это два разных зверя по требованиям к железу. Qwen-32B в Q4_K_M влезает в 24 ГБ VRAM (одна 3090/4090) и работает шустро. Llama-70B требует уже два GPU или агрессивный оффлоад в RAM с потерей скорости. По качеству на русском языке 32B-версия на базе Qwen немного предпочтительнее — Qwen изначально лучше натренирован на многоязычность, это ощущается на задачах с переключением языков.
👍1 ❤️ 🔥1 😄 🤔1
✔ Лучший ответ сформирован автоматически — pharside
Ещё момент по выбору дистиллята: R1-Distill-Qwen-32B и R1-Distill-Llama-70B — это два разных зверя по требованиям к железу. Qwen-32B в Q4_K_M влезает в 24 ГБ VRAM (одна 3090/4090) и работает шустро. Llama-70B требует уже два GPU или агрессивный оффлоад в RAM с потерей скорости. По качеству на русском языке 32B-версия на базе Qwen немного предпочтительнее — Qwen изначально лучше натренирован на…
Перейти к ответу →
Ответить
Поделиться темой: ✈ Telegram VK
Похожие запросы: как запустить llama локальнокак запустить deepseek локальноmistral для локального запуска отзывы

Вернуться в «Локальные LLM и open-source модели»

Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость