DevOps&SRE Library
19.8K subscribers
431 photos
2 videos
2 files
5.44K links
Библиотека статей по теме DevOps и SRE.

Реклама: @ostinostin
Контент: @mxssl

РКН: https://www.gosuslugi.ru/snet/67704b536aa9672b963777b3
Download Telegram
Exposing Kubernetes: Dual HAProxy Setup on Proxmox & Ingress Controller

In cloud environments this problem is usually solved by a managed load balancer. In a self-hosted Proxmox setup we need an equivalent component that sits on the boundary between the public network and the private cluster network. Here, HAProxy plays that role.


https://ruzhnikov.substack.com/p/exposing-kubernetes-dual-haproxy
Debugging processes across container boundaries on Kubernetes

Thankfully on Kubernetes, updates to the ephemeral containers feature and the addition of the --profile and --target options to kubectl debug have greatly simplified this process. There is now a fairly easy means of creating a privileged process context that shares a pid namespace with a specific target container.


https://www.enterprisedb.com/blog/debugging-processes-across-container-boundaries-kubernetes
Luxury Yacht

Luxury Yacht is a cross-platform GUI desktop app for managing Kubernetes clusters and resources.


https://github.com/luxury-yacht/app
kubectl-find

It's a plugin for kubectl that gives you a UNIX find-like experience. Find resource based on name regex, age, labels, status, node name, restarts, image name, or a jq filter — and then print, patch, annotate or delete any.


https://github.com/alikhil/kubectl-find
locust-k8s-operator

The Operator is designed to unlock seamless and effortless distributed performance testing in the cloud and enable continuous integration for CI/CD. By design, the entire system is cloud native and focuses on automation and CI practices. One strong feature about the system is its ability to horizontally scale to meet any required performance demands.


https://github.com/AbdelrhmanHamouda/locust-k8s-operator
Эх, если бы данные можно было просто переносить портальной пушкой — они бы мгновенно оказывались в безопасном месте.
Но вам это не нужно!

Облачное хранилище S3 от Selectel в новом катастрофоустойчивом регионе изначально держит три копии на трех разных площадках в Москве.
Это значит, что ваши данные останутся в полной сохранности и сервисы продолжат работать без паузы, даже если произойдет сбой на одной из площадок.

Почему выбирают S3 в регионе ru-6 от Selectel:

🔹 Надежность. Зоны доступности находятся на расстоянии ~15 км и не зависят друг от друга.

🔹 Удобство. Архитектура готова «из коробки», не нужно вручную распределять реплики между зонами доступности.

🔹 Экономия. Решение обходится дешевле классического аварийного восстановления. При этом распределение по трем площадкам — по цене хранилища без георезервирования.

Узнайте больше о катастрофоустойчивом хранилище в новом регионе ru-6: 👉 https://slc.tl/q4o5z

Реклама. АО "Селектел". erid:2W5zFGTNqcD
Self-blame isn't blameless

Most of what's been written about blameless post-incident reviews is about managers not blaming engineers, and engineers not blaming each other, because blame shuts down learning. What many miss is that engineers still blame themselves, and the damage is the same.


https://greatcircle.com/blog/2026/04/21/self-blame-isnt-blameless
🔍Тестовое собеседование с Head of DevOps уже завтра

18 августа(уже завтра!) в 19:00 по мск приходи онлайн на открытое собеседование, чтобы посмотреть на настоящее интервью на Middle DevOps-разработчика.

Как это будет:
📂 Александр Хренников, Head of DevOps в KTS с опытом 14+ лет, будет задавать реальные вопросы и задачи разработчику-добровольцу
📂 Александр будет комментировать каждый ответ респондента, чтобы дать понять, чего от вас ожидает собеседующий на интервью
📂 В конце можно будет задать любой вопрос Александру

Это бесплатно. Эфир проходит в рамках менторской программы от ШОРТКАТ для DevOps-разработчиков, которые хотят повысить свой грейд, ЗП и прокачать скиллы.

Переходи в нашего бота, чтобы получить ссылку на эфир → @shortcut_devops_bot

Реклама.
О рекламодателе.
Please open Telegram to view this post
VIEW IN TELEGRAM
Automating GCP quota monitoring across multiple projects

Every GCP resource and API have quotas. In a big organization, you can start having production incidents due to hitting quotas you didn't know about in projects you have never touched before.


https://tech.coop.no/blog/platform-engineering/2026/06/25/automating-gcp-quota-monitoring-across-multiple-projects
Optimizing node and pod startup performance

We at Outreach are working hard to improve performance of our platform for our clients. Reducing startup times of nodes and pods can have positive impact on performance and cost as well. I am part of our infrastructure team focusing on AWS and Kubernetes and I recently implemented several improvements in node and startup time. I decided to share some of them in this article.


https://medium.com/outreach-prague/optimizing-node-and-pod-startup-performance-37c5a43d6403
Kubernetes Native FQDN Based Egress Network Policies

Kubernetes Network Policies are powerful, but when it comes to allowing egress access to specific domains, things get tricky. Most real world applications don't connect to fixed IPs, they rely on third-party APIs, cloud services, and CDNs with dynamic DNS records. In this post, I'll take you through the motivation behind building FQDN-Controller, how it works under the hood, and how you can use it to create clean, DNS-aware egress policies natively within Kubernetes.


https://sourcehawk.medium.com/kubernetes-native-fqdn-based-egress-network-policies-cc44105ad138
🔐 Средства защиты в ядре Linux — это фундамент безопасности всей системы.

Если вы хотите понимать:
как защищается ядро;
почему работают SELinux, AppArmor, KASLR и PTI
как проверить защищённость системы на практике, этот практикум для вас.

🗓 20 августа в 20:00 МСК приглашаем вас на открытый урок в преддверии старта курса «Разработка ядра Linux».

Разберём:
• модели DAC и MAC;
• механизмы защиты ядра;
• параметры сборки;
• подпись модулей и ядра;
• а также практические способы проверки настроек безопасности.

После занятия вы поймёте:
как работают современные механизмы защиты Linux;
научитесь анализировать конфигурацию ядра;
оценивать влияние защитных технологий на систему;
увереннее работать с безопасностью на уровне ядра.

Если вы развиваетесь в системном программировании, администрировании или разработке ядра Linux, зарегистрируйтесь на открытый урок, получите практические знания и сделайте следующий шаг к профессиональной работе с ядром Linux/

Регистрация: https://vk.cc/d0AF78

Реклама. ООО «Отус онлайн-образование», ОГРН 1177746618576, www.otus.ru, erid: 2VtzqwcGyWj
kloak

Kloak transparently intercepts outbound TLS traffic in Kubernetes using eBPF uprobes, replacing hashed placeholders with real secrets at the kernel level before encryption. Applications never handle actual credentials, and no sidecars or code changes are required.


https://github.com/spinningfactory/kloak
Бесплатный курс про ИИ для DevOps, SRE и инженеров

Слёрм собрал бесплатный курс в записи «ИИ для инженеров: польза и риски».

Он для тех, кто уже пробовал использовать ИИ в рабочих задачах или только присматривается, но хочет понимать, где модель действительно помогает, а где лучше сначала открыть логи и подумать самому.

В курсе 6 записанных занятий, материалы и самостоятельная практика. Разбираются прикладные сценарии для DevOps, SRE, инфраструктуры и эксплуатации: работа с алёртами, метриками и инцидентами, RAG, ИИ-агенты, SOC, риски для кода и данных, а ещё инженерное мышление в эпоху LLM.

Всё можно проходить в удобном темпе. Без расписания, созвонов и ощущения, что вы опять пропустили что-то важное, пока тушили прод.

Курс бесплатный. Доступ к платформе с курсом открывается через бот

👉🏻Забрать курс

Реклама, ООО "СЛЁРМ", ИНН 3652901451, erid: 2VtzqxCannf
You probably don't need another database

Do you really need separate systems for caching, queues, search, documents, and vector embeddings when you already have Postgres?


https://postgresisenough.dev