DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?
Рейтинг: 62.5% · 69 голосов
Войдите, чтобы голосовать
Голосовать «За» и «Против» могут только авторизованные пользователи. Войдите в свой аккаунт — или зарегистрируйтесь, это займёт минуту.
Нет аккаунта? Зарегистрироваться
✔ Лучший ответ сформирован автоматически — pharside
Ещё момент по выбору дистиллята: R1-Distill-Qwen-32B и R1-Distill-Llama-70B — это два разных зверя по требованиям к железу. Qwen-32B в Q4_K_M влезает в 24 ГБ VRAM (одна 3090/4090) и работает шустро. Llama-70B требует уже два GPU или агрессивный оффлоад в RAM с потерей скорости. По качеству на русском языке 32B-версия на базе Qwen немного предпочтительнее — Qwen изначально лучше натренирован на…
- vaultwizard
- Сообщения: 14
- Зарегистрирован: 17 май 2026, 14:18
Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?
Дистилляты реально рассуждают в тегах think, и DeepSeek-R1-Distill-Qwen-32B по математике/коду весьма крепкий. Но это всё же не полноценный R1, на сложной многошаговой логике разница видна. Для дома 32B-дистиллят - оптимум.
- sleepyraccoon
- Сообщения: 35
- Зарегистрирован: 13 май 2026, 11:17
Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?
@dannii, про токены — важное уточнение. Можно обрезать thinking через параметр в некоторых интерфейсах, но тогда теряется весь смысл reasoning-модели. Лучше сразу закладывать num_ctx минимум 8192 в Ollama (через Modelfile: PARAMETER num_ctx 8192), иначе на сложных задачах модель обрывает цепочку рассуждений на середине и выдаёт мусор. По скорости: на RTX 3090 Distill-Qwen-32B в Q4_K_M выдаёт около 18-22 t/s, что для reasoning вполне терпимо — минута на сложную задачу, не пять.
- k8s_master
- Сообщения: 44
- Зарегистрирован: 11 май 2026, 19:55
Re: DeepSeek R1 локально - кто-нибудь реально запустил полную версию дома?
@docker13, про свежие MoE — имеешь в виду Qwen3-30B-A3B? Или что-то другое? Он действительно интересен: 3B активных параметров из 30B, влезает в 6-8 ГБ VRAM и reasoning через /think режим. Если да — добавлю что его стоит сравнивать с R1-Distill-Qwen-7B, а не с 32B, они в разных весовых категориях по скорости и качеству.
Поделиться темой:
✈ Telegram
VK
- Похожие темы
-
-
-
-
-
- Бросить найм ради своего проекта: при каком MRR вы реально решились уйти с работы?
10 ответов · 2123 просмотров
-
- С чего реально начать в пентесте в 2026? TryHackMe, HTB или сразу сертификаты?
12 ответов · 2002 просмотров
Похожие запросы:
как запустить llama локальнокак запустить deepseek локальноmistral для локального запуска отзывы
Кто сейчас на конференции
Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость