Локальные LLM и open-source модели
Запуск больших языковых моделей локально: Llama, Mistral, Qwen, DeepSeek, Gemma. Квантизация GGUF, Ollama, llama.cpp, vLLM, LM Studio, выбор GPU и оптимизация инференса.
Запускаете нейросети на своём железе без подписок и облаков? Обсуждаем локальный инференс LLM — Llama, Mistral, Qwen, DeepSeek и Gemma, квантизацию в GGUF, связки Ollama, llama.cpp, vLLM и LM Studio. Делимся опытом подбора GPU, ускорения генерации и тонкой настройки моделей под свои задачи. Заходите за бенчмарками, конфигами и живыми советами.
-
- Темы
- Ответы
- Просмотры
- Последнее сообщение
-
- 11 Ответы
- 829 Просмотры
-
Последнее сообщение elixirlover
-
- 7 Ответы
- 58 Просмотры
-
Последнее сообщение lonelygoblin
-
- 5 Ответы
- 51 Просмотры
-
Последнее сообщение sergeyserov
-
- 5 Ответы
- 53 Просмотры
-
Последнее сообщение juniorphoenix
-
- 7 Ответы
- 52 Просмотры
-
Последнее сообщение Kutz
-
- 5 Ответы
- 47 Просмотры
-
Последнее сообщение pandas4
-
- 5 Ответы
- 59 Просмотры
-
Последнее сообщение trasche10
-
- 11 Ответы
- 2388 Просмотры
-
Последнее сообщение misha12
-
- 6 Ответы
- 67 Просмотры
-
Последнее сообщение b1llyn0m
-
- 4 Ответы
- 333 Просмотры
-
Последнее сообщение thumper416
-
- 6 Ответы
- 58 Просмотры
-
Последнее сообщение debian12
-
- 6 Ответы
- 544 Просмотры
-
Последнее сообщение delphin
-
- 6 Ответы
- 67 Просмотры
-
Последнее сообщение davkar
-
- 8 Ответы
- 59 Просмотры
-
Последнее сообщение sleepyraccoon
-
- 7 Ответы
- 46 Просмотры
-
Последнее сообщение svelte_nerd
-
- 5 Ответы
- 48 Просмотры
-
Последнее сообщение joed13
-
- 6 Ответы
- 58 Просмотры
-
Последнее сообщение hunter22
-
- 9 Ответы
- 74 Просмотры
-
Последнее сообщение juniorredteam
-
- 8 Ответы
- 479 Просмотры
-
Последнее сообщение spark_pro
-
- 14 Ответы
- 649 Просмотры
-
Последнее сообщение infern
-
- 7 Ответы
- 47 Просмотры
-
Последнее сообщение cppguru
-
- 6 Ответы
- 50 Просмотры
-
Последнее сообщение kickmybox
-
- 6 Ответы
- 48 Просмотры
-
Последнее сообщение Rhemix
-
- 6 Ответы
- 50 Просмотры
-
Последнее сообщение nixossmith
-
- 7 Ответы
- 55 Просмотры
-
Последнее сообщение kotlinmaster
- Темы этого раздела все теги →
llama.cpp38
Ollama16
MoE15
Qwen15
железо15
GPU10
холивар7
gguf7
vram6
кванты6
квантизация6
контекст6
vLLM6
vllm vs llama.cpp5
локальный-инференс5
LLM5
API4
экономика4
локальные-llm4
mi504
новые модели4
C++4
производительность3
vulkan3
- Популярные запросы раздела
как запустить llama локально
qwen vs llama что лучше
как запустить deepseek локально
mistral для локального запуска отзывы
что такое raid массив и какой уровень выбрать
что такое ubuntu server и зачем он нужен
tarantool как база данных и кэш
лучшая локальная llm для кода
почему postgresql медленный и как ускорить
systemd сервис не запускается после перезагрузки
Кто сейчас на конференции
Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость