Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Рейтинг: 64.6% · 7 голосов
AWS, Google Cloud Platform, Microsoft Azure, Cloudflare, Hetzner: облачные сервисы, архитектура, serverless, стоимость и миграция в облако.
Ответить
Аватара пользователя
envoywizard
Сообщения: 14
Зарегистрирован: 11 май 2026, 20:41

Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Сообщение envoywizard »

Ситуация: 8 месяцев назад запустили EKS-кластер, начинали с $2,000/мес. Сейчас $6,400/мес, функциональность почти не изменилась. Продакт говорит что трафик вырос в полтора раза, но не в три же. Разработчики пожимают плечами. Начали копать — в AWS Cost Explorer всё свалено в кучу. С чего начать разбор?
👍 ❤️2 🔥1 😄 🤔
✔ Лучший ответ сформирован автоматически — vovan99
Из недавнего аудита у себя добавлю пункт, который тут не прозвучал: CloudWatch Logs. Кто-то включил debug-уровень в одном сервисе, Fluent Bit честно лил всё в CloudWatch — и ingestion вышел дороже нод, на которых этот сервис крутился. Отфильтруйте в Cost Explorer сервис CloudWatch отдельной строкой, у EKS-кластеров это регулярно второй-третий источник сюрпризов. Заодно проверьте EBS: если тома…
Перейти к ответу →
Аватара пользователя
Omoto
Сообщения: 120
Зарегистрирован: 12 май 2026, 03:05

Re: Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Сообщение Omoto »

Классическая история. Первое что надо сделать — включить Cost Allocation Tags на уровне кластера. Зайди в EKS → Tags, проставь теги типа team, service, environment на все node groups. Потом в Cost Explorer можно будет разбить по тегам. Без этого ты слепой. На будущее: теги ставить с самого начала, потом очень дорого догонять.
👍 ❤️ 🔥 😄 🤔1
Аватара пользователя
seniorwarlock
Сообщения: 57
Зарегистрирован: 12 май 2026, 00:23

Re: Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Сообщение seniorwarlock »

По моему опыту главные источники неожиданных расходов на EKS: 1) NAT Gateway — трафик между AZ платный ($0.01/GB), и если поды в разных AZ гоняют между собой много данных, это копится быстро. 2) LoadBalancer на каждый сервис — у нас была команда которая создавала Service type=LoadBalancer направо-налево, каждый стоит ~$18/мес просто за существование. 3) PersistentVolumeClaim которые никто не удалил после удаления деплоя — висят и тикают.
👍1 ❤️ 🔥1 😄1 🤔
Аватара пользователя
seniorsamurai
Сообщения: 44
Зарегистрирован: 15 май 2026, 19:29

Re: Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Сообщение seniorsamurai »

Советую поставить Kubecost (есть бесплатный tier) или OpenCost. Они разбивают расходы по неймспейсам, деплойментам, даже по отдельным подам. У нас за первую неделю после установки Kubecost нашли $800/мес «потерянных» ресурсов: staging-namespace который никто не использовал полгода, три LoadBalancer от удалённых сервисов, и job который каждую ночь поднимал жирный под на 15 минут и не освобождал PVC.
👍1 ❤️1 🔥1 😄 🤔1
Аватара пользователя
Tcraw62981
Сообщения: 41
Зарегистрирован: 11 май 2026, 21:02

Re: Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Сообщение Tcraw62981 »

Ещё одна частая причина — overprovisioning requests/limits. Если у тебя requests.cpu=500m на поде а реально используется 50m, нода всё равно считается занятой на 500m и Cluster Autoscaler поднимает новую ноду. Команда: kubectl top pods --all-namespaces | sort -k3 -rn — покажет реальное потребление. Сравни с kubectl get pods -o json | jq '.items[].spec.containers[].resources'. Расхождение больше 3x — тревожный сигнал.
👍 ❤️1 🔥1 😄2 🤔
Аватара пользователя
spaegree
Сообщения: 7
Зарегистрирован: 12 май 2026, 14:55

Re: Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Сообщение spaegree »

Мы делали аудит EKS примерно в похожей ситуации. Итог: 31% расходов — неиспользуемые ресурсы, 24% — избыточный NAT-трафик (починили топологией affinity чтобы поды одного сервиса попадали в одну AZ), 18% — on-demand ноды там где можно было Spot. После оптимизации упали с $5k до $2.8k/мес примерно за месяц работы. Spot Instances для stateless workload — это первое что надо включить, экономия 60-70%.
👍 ❤️ 🔥3 😄1 🤔
Аватара пользователя
seniorwarlock
Сообщения: 57
Зарегистрирован: 12 май 2026, 00:23

Re: Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Сообщение seniorwarlock »

Насчёт Spot: с 2025 года AWS рекомендует использовать Karpenter вместо Cluster Autoscaler. Karpenter умнее подбирает типы инстансов, лучше работает со Spot, и быстрее реагирует на изменение нагрузки. Если ещё на старом CA — рассмотрите миграцию, у нас это дало ещё -15% к счёту просто за счёт лучшего bin-packing.
👍1 ❤️3 🔥 😄 🤔
Аватара пользователя
vovan99
Сообщения: 5
Зарегистрирован: 12 май 2026, 10:49

Re: Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Сообщение vovan99 »

✔ Лучший ответ — сформирован автоматически
Из недавнего аудита у себя добавлю пункт, который тут не прозвучал: CloudWatch Logs. Кто-то включил debug-уровень в одном сервисе, Fluent Bit честно лил всё в CloudWatch — и ingestion вышел дороже нод, на которых этот сервис крутился. Отфильтруйте в Cost Explorer сервис CloudWatch отдельной строкой, у EKS-кластеров это регулярно второй-третий источник сюрпризов. Заодно проверьте EBS: если тома ещё на gp2, перевод на gp3 даёт минус 20% по дискам вообще без усилий.
👍1 ❤️2 🔥 😄1 🤔
Аватара пользователя
teatree
Сообщения: 10
Зарегистрирован: 17 май 2026, 20:04

Re: Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Сообщение teatree »

@Tcraw62981, ручное сравнение kubectl top с requests работает, но на полусотне деплойментов превращается в пытку. Goldilocks — обёртка над VPA в режиме рекомендаций — делает то же самое автоматом и рисует по каждому контейнеру: вот request, вот реальный p95, вот рекомендация. Мы по его данным срезали requests примерно на 40%, и Autoscaler перестал держать две лишние ноды просто «на всякий случай».
👍 ❤️ 🔥 😄 🤔
Аватара пользователя
torcher
Сообщения: 5
Зарегистрирован: 18 май 2026, 16:28

Re: Kubernetes на AWS EKS — счёт вырос в 3 раза за квартал, ищем где утечка

Сообщение torcher »

@spaegree, с affinity в одну AZ аккуратнее — вы же этим режете отказоустойчивость: уйдёт зона, ляжет весь сервис целиком. Мы ту же проблему NAT-трафика решали через topology aware routing: реплики остаются размазаны по зонам через topologySpreadConstraints, но трафик между сервисами роутится внутри своей AZ. Межзонные гигабайты упали почти так же, как у вас, а HA не пострадала.
👍 ❤️ 🔥 😄1 🤔
Ответить
Поделиться темой: ✈ Telegram VK
Похожие запросы: что такое kubernetes и зачем он нуженterraform для kubernetes в yandex cloudkubernetes или docker swarm что выбратьkubernetes для начинающих с чего начатьkubernetes pod висит в pending что делать

Вернуться в «Облачные платформы»

Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость