DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Теги: #DeepSeek
Рейтинг: 62.5% · 69 голосов
Запуск больших языковых моделей локально: Llama, Mistral, Qwen, DeepSeek, Gemma. Квантизация GGUF, Ollama, llama.cpp, vLLM, LM Studio, выбор GPU и оптимизация инференса.
Аватара пользователя
Bill2001
Сообщения: 86
Зарегистрирован: 16 май 2026, 20:24

DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение Bill2001 »

Везде хайп про DeepSeek R1, но полная модель это 671B параметров. Народ выкладывает скрины с локальным запуском - это дистилляты или реально оригинал? Хочется reasoning локально, но без датацентра.
👍1 ❤️2 🔥3 😄1 🤔
✔ Лучший ответ сформирован автоматически — pharside
Ещё момент по выбору дистиллята: R1-Distill-Qwen-32B и R1-Distill-Llama-70B — это два разных зверя по требованиям к железу. Qwen-32B в Q4_K_M влезает в 24 ГБ VRAM (одна 3090/4090) и работает шустро. Llama-70B требует уже два GPU или агрессивный оффлоад в RAM с потерей скорости. По качеству на русском языке 32B-версия на базе Qwen немного предпочтительнее — Qwen изначально лучше натренирован на…
Перейти к ответу →
Аватара пользователя
vaultwizard
Сообщения: 14
Зарегистрирован: 17 май 2026, 14:18

Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение vaultwizard »

Полный R1 671B дома гоняют единицы и то на сборках с 512+ ГБ RAM через mmap, скорость 1-2 t/s, на терпеливого. То что у большинства на скринах - дистилляты в Qwen/Llama (7B-70B). Не путай, это разные звери.
👍1 ❤️ 🔥 😄1 🤔
Аватара пользователя
docker13
Сообщения: 23
Зарегистрирован: 12 май 2026, 16:43

Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение docker13 »

Был unsloth с динамическим квантом до ~130-150 ГБ, который якобы тащит на двух 3090 + оффлоад в RAM. Запускал - работает, но медленно, для чата неюзабельно, для оффлайн-задач сойдёт.
👍8 ❤️1 🔥 😄1 🤔1
Аватара пользователя
valru
Сообщения: 63
Зарегистрирован: 11 май 2026, 05:24

Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение valru »

А дистилляты R1 вообще держат тот самый reasoning или это маркетинг? Стоит ли с ними возиться?
👍 ❤️ 🔥1 😄 🤔
Аватара пользователя
tx3300
Сообщения: 29
Зарегистрирован: 13 май 2026, 07:30

Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение tx3300 »

Дистилляты реально рассуждают в тегах think, и DeepSeek-R1-Distill-Qwen-32B по математике/коду весьма крепкий. Но это всё же не полноценный R1, на сложной многошаговой логике разница видна. Для дома 32B-дистиллят - оптимум.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
leelo
Сообщения: 18
Зарегистрирован: 19 май 2026, 17:46

Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение leelo »

Учтите что reasoning-модели жрут токены пачками, генерят простыни размышлений. На 30 t/s ответ может ехать минуту. Закладывайте контекст побольше и терпение.
👍1 ❤️ 🔥 😄 🤔
Аватара пользователя
dannii
Сообщения: 20
Зарегистрирован: 13 май 2026, 20:46

Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение dannii »

И да, есть свежие MoE поменьше которые на одной карте летают и тоже умеют ризонинг. Иногда смысла гнаться за 671B нет вообще, если задача не на грани возможностей.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
sleepyraccoon
Сообщения: 35
Зарегистрирован: 13 май 2026, 11:17

Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение sleepyraccoon »

Понял, возьму 32B-дистиллят для начала, а полный R1 оставлю мечтой до апгрейда оперативки. Спасибо за развёрнутые ответы!
👍2 ❤️ 🔥1 😄 🤔
Аватара пользователя
Bill2001
Сообщения: 86
Зарегистрирован: 16 май 2026, 20:24

Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение Bill2001 »

@dannii, про токены — важное уточнение. Можно обрезать thinking через параметр в некоторых интерфейсах, но тогда теряется весь смысл reasoning-модели. Лучше сразу закладывать num_ctx минимум 8192 в Ollama (через Modelfile: PARAMETER num_ctx 8192), иначе на сложных задачах модель обрывает цепочку рассуждений на середине и выдаёт мусор. По скорости: на RTX 3090 Distill-Qwen-32B в Q4_K_M выдаёт около 18-22 t/s, что для reasoning вполне терпимо — минута на сложную задачу, не пять.
👍3 ❤️ 🔥 😄 🤔2
Аватара пользователя
k8s_master
Сообщения: 44
Зарегистрирован: 11 май 2026, 19:55

Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?

Сообщение k8s_master »

@docker13, про свежие MoE — имеешь в виду Qwen3-30B-A3B? Или что-то другое? Он действительно интересен: 3B активных параметров из 30B, влезает в 6-8 ГБ VRAM и reasoning через /think режим. Если да — добавлю что его стоит сравнивать с R1-Distill-Qwen-7B, а не с 32B, они в разных весовых категориях по скорости и качеству.
👍2 ❤️1 🔥 😄 🤔
Ответить
Поделиться темой: ✈ Telegram VK
Похожие запросы: как запустить llama локальнокак запустить deepseek локальноmistral для локального запуска отзывы

Вернуться в «Локальные LLM и open-source модели»

Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость