Какую видеокарту брать под локальные LLM в 2026, 3090 бу или новая 5070 Ti
Рейтинг: 82.4% · 18 голосов
Войдите, чтобы голосовать
Голосовать «За» и «Против» могут только авторизованные пользователи. Войдите в свой аккаунт — или зарегистрируйтесь, это займёт минуту.
Нет аккаунта? Зарегистрироваться
Какую видеокарту брать под локальные LLM в 2026, 3090 бу или новая 5070 Ti
Собираю комнатный сервер под 27-32B модели в 4 битах, бюджет до 100к, и завис между бу 3090 на 24 гб и новой 5070 Ti на 16. Что реально лучше для инференса в llama.cpp, контекст хочу хотя бы 16к, иногда 32. По токенам 5070 быстрее на бумаге, но 16 гб упирается, на 3090 влезает Qwen 32B q4 целиком плюс контекст. Кто на чем сидит, что посоветуете под такие задачи.
✔ Лучший ответ сформирован автоматически — radiomaker
@cronk, @автор у меня две 3090 в связке, 70B q4 крутится на 15-17 ток/с через vllm с tensor parallel. одна 3090 тянет 32B q4 спокойно, контекст 32к влезает если kv-кэш в q8. брал прошлым летом по 55к за штуку с авито, сейчас ближе к 60-65 просят, мониторь объявы там разброс дикий. из подводных: проверяй термопрокладки на памяти, у майнерских часто деградировали, я перебирал обе, температуры…
- radiomaker
- Сообщения: 27
- Зарегистрирован: 24 май 2026, 00:35
Re: Какую видеокарту брать под локальные LLM в 2026, 3090 бу или новая 5070 Ti
✔ Лучший ответ — сформирован автоматически
@cronk, @автор у меня две 3090 в связке, 70B q4 крутится на 15-17 ток/с через vllm с tensor parallel. одна 3090 тянет 32B q4 спокойно, контекст 32к влезает если kv-кэш в q8. брал прошлым летом по 55к за штуку с авито, сейчас ближе к 60-65 просят, мониторь объявы там разброс дикий. из подводных: проверяй термопрокладки на памяти, у майнерских часто деградировали, я перебирал обе, температуры памяти были под 100 пока не поменял. блок бери минимум 850 ватт если одна карта, на две уже 1200 с запасом. и корпус с продувом, эти кирпичи греются будь здоров
- k8s_master
- Сообщения: 44
- Зарегистрирован: 11 май 2026, 19:55
Re: Какую видеокарту брать под локальные LLM в 2026, 3090 бу или новая 5070 Ti
если не игры то посмотри ещё в сторону mi50 32гб с алиэкспресса, их сейчас задёшево скидывают, 15-18к за 32 гига вмрам звучит вкусно. минус роком ад и дрова пляски, под llama.cpp заводится но не для слабонервных
Re: Какую видеокарту брать под локальные LLM в 2026, 3090 бу или новая 5070 Ti
@darthb, по prompt processing на одиночной 3090 у меня qwen 32B q4_k_m даёт где-то 600-700 ток/с префилл на пустом контексте, ближе к 16к падает до 300-350. генерация 28-32 ток/с на коротком, на забитом контексте 20-22. так что 16к юзабельно, 32к уже задумчиво но терпимо. для кода и переписки норм, для агентских циклов с большим контекстом начинает раздражать ожидание
Поделиться темой:
✈ Telegram
VK
- Похожие темы
-
-
- Счёт от AWS вырос в 3 раза за месяц, не могу понять за что — помогите разобраться
11 ответов · 1257 просмотров
-
-
- Джун: стоит ли брать Rust первым серьёзным языком в 2026, или это самонадеянно?
8 ответов · 860 просмотров
-
- Ollama vs llama.cpp vs vLLM - что выбрать в 2026, запутался окончательно
10 ответов · 829 просмотров
-
- KMP с Compose Multiplatform или Flutter — что выбрать под новый продукт в 2026?
13 ответов · 804 просмотров
Кто сейчас на конференции
Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость