Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Рейтинг: 52.9% · 28 голосов
Docker, Kubernetes, Helm, Terraform, Ansible, GitLab CI, GitHub Actions: автоматизация деплоя, инфраструктура как код, мониторинг и observability.
Аватара пользователя
hogan20
Сообщения: 71
Зарегистрирован: 13 май 2026, 12:49

Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Сообщение hogan20 »

Prometheus с retention 15 дней стал жрать под 64 гига RAM и периодически падает по OOM при тяжёлых запросах в графане. Кардинальность метрик около пары миллионов серий. Смотрю в сторону VictoriaMetrics и Grafana Mimir, что выбрать?
👍1 ❤️ 🔥 😄 🤔
Аватара пользователя
lorenzinoarq
Сообщения: 65
Зарегистрирован: 11 май 2026, 00:03

Re: Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Сообщение lorenzinoarq »

VictoriaMetrics. У нас был такой же сценарий, после миграции потребление памяти упало раза в четыре на тех же данных. Single-node VM спокойно тянет то, на чём Prometheus загибался, а конфиг в разы проще чем кластер Mimir.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
grumpylurker
Сообщения: 63
Зарегистрирован: 15 май 2026, 01:41

Re: Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Сообщение grumpylurker »

Mimir хорош если вам реально нужен горизонтальный мультитенант-скейл и вы уже в экосистеме Grafana с Loki и Tempo. Но операционно это тяжёлый зверь, куча компонентов, минио или s3 под чанки. Для одной команды это перебор.
👍4 ❤️1 🔥3 😄2 🤔1
Аватара пользователя
hogan20
Сообщения: 71
Зарегистрирован: 13 май 2026, 12:49

Re: Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Сообщение hogan20 »

Мультитенант не нужен, у нас одна команда но много сервисов. Звучит как что VM подходит больше. А PromQL там полностью совместим?
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
alla_mihailova
Сообщения: 18
Зарегистрирован: 11 май 2026, 02:51

Re: Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Сообщение alla_mihailova »

Да, VM поддерживает PromQL плюс свой MetricsQL с расширениями. Дашборды из графаны переехали без переделки, просто поменяли datasource. Remote write из существующих прометеев настраивается за пять минут.
👍2 ❤️ 🔥 😄 🤔1
Аватара пользователя
asyncmonk
Сообщения: 62
Зарегистрирован: 13 май 2026, 16:00

Re: Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Сообщение asyncmonk »

Добавлю по кардинальности: прежде чем мигрировать, посмотрите cardinality explorer в VM, часто половина серий это мусорные лейблы типа pod_id или request_id которые кто-то залепил в метрики. Почистите источник и возможно даже миграция не понадобится.
👍 ❤️1 🔥1 😄 🤔
Аватара пользователя
Tcraw62981
Сообщения: 41
Зарегистрирован: 11 май 2026, 21:02

Re: Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Сообщение Tcraw62981 »

Вот это дельный совет, про request_id в лейблах прям в точку, грешим этим. Сначала почищу кардинальность, потом уже буду смотреть на переезд. Спасибо!
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
seniorsamurai
Сообщения: 44
Зарегистрирован: 15 май 2026, 19:29

Re: Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Сообщение seniorsamurai »

Мы крутим VictoriaMetrics в кластерном режиме почти три года, полёт нормальный. Единственное, бекапы через vmbackup настройте сразу, по умолчанию их нет и легко об этом забыть до первого инцидента.
👍1 ❤️ 🔥 😄1 🤔1
Аватара пользователя
timur12
Сообщения: 30
Зарегистрирован: 13 май 2026, 01:35

Re: Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Сообщение timur12 »

У меня после этого способа всё завелось, спасибо за наводку.
👍 ❤️ 🔥1 😄1 🤔
Аватара пользователя
tomcruz
Сообщения: 29
Зарегистрирован: 12 май 2026, 18:25

Re: Prometheus задыхается на нашем масштабе, мигрировать на VictoriaMetrics или Mimir?

Сообщение tomcruz »

@lorenzinoarq, в четыре раза это у вас прям идеальный кейс. У нас на 3 млн серий вышло примерно в два, что тоже отлично, но люди начитаются про x4 и потом удивляются. Сильно зависит от churn, если поды пересоздаются часто, экономия заметно скромнее.
👍2 ❤️1 🔥 😄 🤔1
Ответить
Поделиться темой: ✈ Telegram VK
Похожие запросы: первые шаги мониторинга сервера linux для новичка

Вернуться в «DevOps и CI/CD»

Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость