бенчмарки

Цифры против маркетинга вот суть этого раздела. Здесь гоняют замеры скорости и качества моделей: правда ли Ollama медленнее чистого llama.cpp на заявленные 23 процента, стоит ли Gemma 4 26B менять привычные Mistral и Qwen, и кто умнее на деле 70B в агрессивном кванте IQ2_XXS или компактная 14B в Q6. Обсуждают методологию, ловушки синтетики и расхождение бенчей с реальными задачами. Незаменимо тем, кто выбирает локальную LLM или железо и устал верить пресс-релизам на слово.

3 тем, 22 ответов, 186 просмотров · все теги

Похожие теги: Ollama 1llama.cpp 1RTX4090 1google 1Gemma4 1локальный запуск 1холивар 1кванты 1