4 MCP-сервера, о которых стоит знать каждому DevOps-инженеру
1. Kubernetes MCP
- расследовать pod’ы в
- дебажить неудачные деплои;
- анализировать состояние кластера.
https://github.com/Flux159/mcp-server-kubernetes
2. AWS MCP
- разбирать резкие скачки расходов в AWS;
- находить неиспользуемые ресурсы;
- troubleshooting облачной инфраструктуры.
https://github.com/awslabs/mcp
3. Terraform MCP
- проверять Terraform-планы;
- находить drift в инфраструктуре;
- объяснять изменения в инфраструктуре.
https://github.com/hashicorp/terraform-mcp-server
4. Grafana + Prometheus MCP
- расследовать скачки latency;
- анализировать production-инциденты;
- объяснять alert storms.
https://github.com/grafana/mcp-grafana
https://github.com/pab1it0/prometheus-mcp-server
MemOps🤨
1. Kubernetes MCP
- расследовать pod’ы в
CrashLoopBackOff;- дебажить неудачные деплои;
- анализировать состояние кластера.
https://github.com/Flux159/mcp-server-kubernetes
2. AWS MCP
- разбирать резкие скачки расходов в AWS;
- находить неиспользуемые ресурсы;
- troubleshooting облачной инфраструктуры.
https://github.com/awslabs/mcp
3. Terraform MCP
- проверять Terraform-планы;
- находить drift в инфраструктуре;
- объяснять изменения в инфраструктуре.
https://github.com/hashicorp/terraform-mcp-server
4. Grafana + Prometheus MCP
- расследовать скачки latency;
- анализировать production-инциденты;
- объяснять alert storms.
https://github.com/grafana/mcp-grafana
https://github.com/pab1it0/prometheus-mcp-server
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4👍2🔥2
Кто работает, когда ничего не работает: от алерта до постмортема
📌 Подробнее: https://habr.com/ru/companies/k2tech/articles/1054620/
MemOps🤨
Четыре года мы были уверены, что во время инцидента с клиентом должна общаться первая линия поддержки. Потом решили, что это должен делать сам исполнитель тикета. Оба подхода не работали — по разным причинам. Этот текст — о том, к чему мы пришли, и о реальном инциденте, который проверил итоговую схему на прочность.
Когда 20 ноября 2025 года из-за ошибки в конфигурации одного коммутатора отказала дисковая подсистема всей платформы, пятьдесят наших клиентов одновременно открыли тикеты. В этот момент выяснилось главное: техническая проблема была одна, а коммуникационных — десятки. Инцидент в инфраструктуре можно устранить за часы; инцидент доверия, если им не управлять, длится гораздо дольше. Именно поэтому зрелая поддержка — это не инженер за терминалом, а параллельно работающая система: одни чинят, другие в этот момент разговаривают с бизнесом клиента.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
Новая конвертация из CPU Shares cgroup v1 в CPU Weight v2
📌 Подробнее: https://kubernetes.io/blog/2026/01/30/new-cgroup-v1-to-v2-cpu-conversion-formula
MemOps🤨
Я рад объявить о реализации улучшенной формулы конвертации из CPU shares cgroup v1 в CPU weight cgroup v2. Это улучшение решает критические проблемы с распределением приоритетов CPU для рабочих нагрузок Kubernetes при запуске на системах с cgroup v2.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
Kubernetes
New Conversion from cgroup v1 CPU Shares to v2 CPU Weight
I'm excited to announce the implementation of an improved conversion formula from cgroup v1 CPU shares to cgroup v2 CPU weight. This enhancement addresses critical issues with CPU priority allocation for Kubernetes workloads when running on systems with cgroup…
👍3❤1
kubecfg — менеджер конфигурации Kubernetes для тех, кто часто переключает контексты и нуждается в большем, чем просто тонкая обертка вокруг kubectl config.
📌 Подробнее: https://github.com/kadirbelkuyu/kubecfg
MemOps🤨
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - kadirbelkuyu/kubecfg: A fast, secure CLI tool for managing Kubernetes kubeconfig files.
A fast, secure CLI tool for managing Kubernetes kubeconfig files. - kadirbelkuyu/kubecfg
Удаленное выполнение кода в Kubernetes через узлы/прокси GET Permission
📌 Подробнее: https://grahamhelton.com/blog/nodes-proxy-rce
MemOps🤨
В этом посте я опишу, как выполнять код на каждом Pod во многих кластерах Kubernetes при использовании учетной записи службы с разрешениями nodes/proxy GET. Эта проблема была первоначально сообщена через процесс раскрытия уязвимостей Kubernetes и закрыта как работающая по назначению.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
Graham Helton
Kubernetes Remote Code Execution
Via Nodes/Proxy GET Permission
Via Nodes/Proxy GET Permission
An authorization bypass in
Kubernetes RBAC allows for nodes/proxy GET permissions to execute
commands in any Pod in the cluster.
Kubernetes RBAC allows for nodes/proxy GET permissions to execute
commands in any Pod in the cluster.