Купил 5090 под локальные модели и разочаровался, делюсь болью
Рейтинг: 40.9% · 8 голосов
Войдите, чтобы голосовать
Голосовать «За» и «Против» могут только авторизованные пользователи. Войдите в свой аккаунт — или зарегистрируйтесь, это займёт минуту.
Нет аккаунта? Зарегистрироваться
- thumper416
- Сообщения: 66
- Зарегистрирован: 12 май 2026, 19:00
Купил 5090 под локальные модели и разочаровался, делюсь болью
Взял RTX 5090 за 280к специально под локальные LLM и теперь сижу думаю что погорячился. 32гб vram это конечно больше чем 24 у 4090, но не настолько чтобы качественно сменить лигу моделей. 70B все равно целиком не лезет, а 32B и на 4090 неплохо шли. Ожидал прорыва а получил +33% памяти за двойную цену. Может кто переубедит что я не зря деньги слил.
✔ Лучший ответ сформирован автоматически — Vvz1995
thumper416 писал(а):32B и на 4090 неплохо шли вот в этом и ошибка планирования. 5090 берут не ради влезания новых моделей по объему, а ради скорости памяти. У 5090 пропускная способность около 1.8 TB/s против 1 TB/s у 4090. Для инференса который упирается в bandwidth это прямой буст токенов. Если у тебя Qwen2.5 32B Q4 на 4090 шла 40 т/с то на 5090 будет 65-75 т/с, это очень заметно в…
Re: Купил 5090 под локальные модели и разочаровался, делюсь болью
✔ Лучший ответ — сформирован автоматически
вот в этом и ошибка планирования. 5090 берут не ради влезания новых моделей по объему, а ради скорости памяти. У 5090 пропускная способность около 1.8 TB/s против 1 TB/s у 4090. Для инференса который упирается в bandwidth это прямой буст токенов. Если у тебя Qwen2.5 32B Q4 на 4090 шла 40 т/с то на 5090 будет 65-75 т/с, это очень заметно в интерактивном чате и особенно в агентных цепочках где ждешь каждый ответ. Плюс 32гб реально открывают 32B модели в Q6/Q8 с большим контекстом без компромиссов, а не только Q4 впритык. И KV-кеш на длинных контекстах больше не душит. Так что прорыв есть, просто он не в размере модели а в скорости и комфорте. Хотя за 280к согласен, ценник конский, в долларах карта раза в полтора дешевле но к нам едет через парапланы.thumper416 писал(а):32B и на 4090 неплохо шли
Re: Купил 5090 под локальные модели и разочаровался, делюсь болью
и киловатт жора, выводок проводов, риски купить ушатанную майнингом карту и геморрой с tensor parallelism. одна 5090 это plug and play и тишина. разные подходы для разных людей, не все хотят колхозить ферму дома ради экономииcronk писал(а):три 3090 с авито это 72гб суммарной vram
- seniorwarlock
- Сообщения: 57
- Зарегистрирован: 12 май 2026, 00:23
- solidity2024
- Сообщения: 40
- Зарегистрирован: 11 май 2026, 02:34
Поделиться темой:
✈ Telegram
VK
- Похожие темы
-
- Поднял цену с $9 до $29 — ушла половина юзеров, но MRR вырос. Делюсь цифрами
21 ответов · 1176 просмотров
-
- Свалил с Unity на Godot 4.4 после истории с runtime fee — спустя полгода честно делюсь
17 ответов · 920 просмотров
-
- WireGuard режут DPI за минуту, перешёл на VLESS+Reality — делюсь граблями
18 ответов · 872 просмотров
-
-
- Утечка памяти в Node, +2ГБ в сутки, рестарт каждую ночь по крону. Нашёл, делюсь
16 ответов · 765 просмотров
-
- Container queries — наконец-то выкинул половину медиа-запросов, делюсь лайфхаком
9 ответов · 439 просмотров
Кто сейчас на конференции
Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость