Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Рейтинг: 59.6% · 10 голосов
Docker, Kubernetes, Helm, Terraform, Ansible, GitLab CI, GitHub Actions: автоматизация деплоя, инфраструктура как код, мониторинг и observability.
Ответить
Аватара пользователя
Omoto
Сообщения: 120
Зарегистрирован: 12 май 2026, 03:05

Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Сообщение Omoto »

Поднял кластер Kubernetes на трёх нодах, всё работает, но мониторинга ноль. Хочу видеть: загрузку CPU и памяти по подам и нодам, алерты если что-то падает или потребляет слишком много ресурсов, и дашборды с историей. Смотрю на Prometheus + Grafana, но там куча компонентов — kube-state-metrics, node-exporter, alertmanager. Есть ли простой способ всё это поднять разом?
👍 ❤️ 🔥 😄1 🤔1
✔ Лучший ответ выбран автором и совпадает с автоматическим подбором — omnicrom
Развёрнутая инструкция по алертингу. После установки стека создай свои алерты через PrometheusRule CRD. Пример правила для высокого CPU пода: apiVersion: monitoring.coreos.com/v1 kind: PrometheusRule metadata: name: pod-alerts namespace: monitoring с alerting rules — выражение rate(container_cpu_usage_seconds_total[5m]) > 0.8 и severity: warning. Для алертов в Telegram или Slack настрой…
Перейти к ответу →
Аватара пользователя
asynclover
Сообщения: 70
Зарегистрирован: 13 май 2026, 04:35

Re: Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Сообщение asynclover »

kube-prometheus-stack через Helm — это стандартный путь. Одна команда разворачивает весь стек: helm repo add prometheus-community https://prometheus-community.github.io/helm-charts && helm install monitoring prometheus-community/kube-prometheus-stack -n monitoring --create-namespace. Получишь Prometheus, Grafana, Alertmanager, node-exporter и kube-state-metrics в одном флаконе. Grafana идёт с преднастроенными дашбордами для k8s.
👍 ❤️ 🔥1 😄 🤔1
Аватара пользователя
guardia
Сообщения: 49
Зарегистрирован: 11 май 2026, 14:59

Re: Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Сообщение guardia »

После установки kube-prometheus-stack Grafana доступна через port-forward: kubectl port-forward svc/monitoring-grafana 3000:80 -n monitoring. Логин admin, пароль по умолчанию prom-operator (меняй через values.yaml: grafana.adminPassword). Дашборды с ID 315 и 6417 на grafana.com — отличные для обзора кластера, импортируются за секунды.
👍1 ❤️1 🔥 😄1 🤔
Аватара пользователя
carv
Сообщения: 22
Зарегистрирован: 12 май 2026, 07:33

Re: Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Сообщение carv »

Не забудь настроить PersistentVolume для Prometheus иначе при рестарте пода вся история метрик потеряется. В values.yaml: prometheus.prometheusSpec.storageSpec.volumeClaimTemplate.spec.resources.requests.storage: 50Gi. Ещё retention — по умолчанию 10 дней, можно увеличить: prometheus.prometheusSpec.retention: 30d.
👍3 ❤️ 🔥 😄 🤔2
Аватара пользователя
omnicrom
Сообщения: 32
Зарегистрирован: 11 май 2026, 07:08

Re: Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Сообщение omnicrom »

✔ Лучший ответ — выбран автором и совпадает с авто-подбором
Развёрнутая инструкция по алертингу. После установки стека создай свои алерты через PrometheusRule CRD. Пример правила для высокого CPU пода: apiVersion: monitoring.coreos.com/v1 kind: PrometheusRule metadata: name: pod-alerts namespace: monitoring с alerting rules — выражение rate(container_cpu_usage_seconds_total[5m]) > 0.8 и severity: warning. Для алертов в Telegram или Slack настрой Alertmanager через секрет alertmanager-monitoring-kube-prometheus-alertmanager: в конфиге receivers указываешь slack_configs или telegram_configs с webhook URL. Для Telegram нужен бот — создаёшь через BotFather, получаешь токен и chat_id. Важные алерты которые стоит настроить сразу: PodCrashLooping (контейнер рестартует больше 5 раз за 10 минут), NodeMemoryPressure, PersistentVolumeFillingUp (заполнение PV > 85%), DeploymentReplicasMismatch (желаемое число реплик не совпадает с реальным). kube-prometheus-stack уже включает набор готовых алертов из kubernetes-mixin, изучи их прежде чем писать свои — скорее всего нужное уже есть.
👍3 ❤️1 🔥2 😄1 🤔
Аватара пользователя
infern
Сообщения: 87
Зарегистрирован: 11 май 2026, 10:23

Re: Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Сообщение infern »

Для production советую сразу смотреть в сторону VictoriaMetrics вместо Prometheus — она потребляет в 5-7 раз меньше памяти при той же нагрузке и умеет горизонтальное масштабирование. Есть victoria-metrics-k8s-stack — аналог kube-prometheus-stack, совместим с теми же дашбордами и правилами.
👍 ❤️ 🔥1 😄1 🤔
Аватара пользователя
svelte88
Сообщения: 63
Зарегистрирован: 12 май 2026, 11:49

Re: Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Сообщение svelte88 »

Если кластер managed (EKS, GKE, AKS) — у провайдеров есть встроенный мониторинг. CloudWatch Container Insights для EKS, Google Cloud Monitoring для GKE. Не всегда так гибко как Prometheus, но для начала можно сэкономить время на настройке.
👍1 ❤️1 🔥 😄1 🤔
Аватара пользователя
jbosco
Сообщения: 60
Зарегистрирован: 11 май 2026, 02:28

Re: Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Сообщение jbosco »

Поднимал ровно такой же стек на трёхнодовом кластере недавно. Один момент, который тут не прозвучал: свои приложения сами в мониторинг не попадут — для них нужен ServiceMonitor или PodMonitor с лейблом, который матчится селектором оператора. По умолчанию Prometheus Operator смотрит только на ресурсы с release-лейблом своего Helm-релиза, и народ потом часами ищет, почему метрики кластера есть, а метрик приложения нет. Это первые грабли после установки стека.
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
ninja_marina
Сообщения: 11
Зарегистрирован: 18 май 2026, 03:57

Re: Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Сообщение ninja_marina »

@carv, дополню про retention: кроме retention: 30d стоит сразу задать retentionSize: 45GB при диске 50Gi. Иначе при всплеске кардинальности (кто-то добавил label с user_id в метрику — классика) диск забьётся задолго до 30 дней и Prometheus просто встанет. Лимит по размеру надёжнее лимита по времени, а вместе они дают предсказуемое поведение.
👍1 ❤️1 🔥 😄 🤔
Аватара пользователя
merengue
Сообщения: 14
Зарегистрирован: 12 май 2026, 08:55

Re: Настройка мониторинга Kubernetes кластера с Prometheus и Grafana с нуля

Сообщение merengue »

@infern, для прода с нагрузкой согласен, но человеку с тремя нодами и нулевым опытом я бы не советовал стартовать с VictoriaMetrics. У kube-prometheus-stack гигантское комьюнити, любая ошибка гуглится за минуту, все туториалы и примеры алертов написаны под него. Сначала понять модель Prometheus, PromQL и Alertmanager, а когда реально упрёшься в память — переехать на VM осознанно. Совместимость дашбордов как раз позволяет сделать это потом почти бесплатно.
👍 ❤️2 🔥 😄 🤔1
Ответить
Поделиться темой: ✈ Telegram VK
Похожие запросы: что такое kubernetes и зачем он нуженterraform для kubernetes в yandex cloudпервичная настройка jenkins после установкиss как посмотреть открытые сокеты и соединенияminikube или kind что выбрать для локального кластера kuberneteskubectl get describe logs основные команды для работы с кластером

Вернуться в «DevOps и CI/CD»

Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость