VibeOps: Безопасная настройка только для чтения для отладки Kubernetes с помощью ИИ
📌 Подробнее: https://simon-frey.com/blog/vibeops-kubernetes
MemOps🤨
Сейчас много шума вокруг того, чтобы позволить ИИ «исправлять» вашу инфраструктуру. Когда в продакшене начинаются проблемы, вам нужно поддерживать полную ментальную модель системы. Если вы позволите ИИ стать движущей силой, вы потеряете общий обзор.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
Blog by Simon Frey
VibeOps: A Secure read-only setup for AI-Assisted Kubernetes (k8s) Debugging - Blog by Simon Frey
There is a lot of noise right now about letting AI "fix" your infrastructure (be it via aws cli commands, or in the case for this article: kubernetes). You past
Управление ключами SSH — вызовы и эволюция подходов
📌 Подробнее: https://habr.com/ru/companies/selectel/articles/1056850/
MemOps🤨
В инфраструктуре из 1000 серверов и 100 администраторов счет активным SSH-ключам может идти на тысячи. По умолчанию они не имеют срока действия, поэтому со временем накапливаются и устаревают.
Исследования показывают, что в крупных компаниях до 90% ключей не используются и не администрируются, а часть оставшихся предоставляет доступ на уровне root. Отсутствие централизованного управления усугубляет проблему: при увольнении сотрудника его доступы могут забыть удалить, сохранив за ним возможность подключаться к системам.
В итоге администраторы оказываются перед трудоемкой задачей контроля и актуализации авторизационных данных.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2❤1
Incident Relay
📌 Подробнее: https://github.com/roxy-wi/IncidentRelay/
https://habr.com/ru/articles/1070294/
MemOps🤨
Incident Relay закрывает базовый incident workflow: маршрутизация алертов, дежурства и ротации, ACK/Resolve, напоминания, эскалации, silences и maintenance windows.
Из коробки есть интеграции с Zabbix, Grafana, Alertmanager, Datadog, Sentry и другими источниками, а уведомления можно отправлять в Telegram, Slack, Mattermost, Teams, email, webhook и даже голосовыми звонками.
Плюс всё можно держать у себя — Docker, Kubernetes/Helm или обычный systemd/RPM. В общем, практичный вариант для команд, которым нужен on-call без SaaS и с полным контролем над маршрутизацией алертов.
https://habr.com/ru/articles/1070294/
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Spiderpool — базовое сетевое решение с технологией RDMA для Kubernetes. Оно расширяет возможности Macvlan CNI, ipvlan CNI, SR-IOV CNI, удовлетворяет различные сетевые потребности и поддерживает работу в средах «голого железа», виртуальных машин и общедоступных облачных сервисов. Spiderpool обеспечивает исключительную производительность сети, что особенно важно для приложений с интенсивным сетевым вводом-выводом и низкой задержкой, таких как хранилища данных, промежуточное программное обеспечение и искусственный интеллект.
📌 Подробнее: https://spidernet-io.github.io/spiderpool/v1.2/
MemOps🤨
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
plugins/plugins/main/macvlan at main · containernetworking/plugins
Some reference and example networking plugins, maintained by the CNI team. - containernetworking/plugins
👍2
Открытие Kubernetes: Двойная настройка HAProxy на Proxmox и контроллер Ingress
📌 Подробнее: https://ruzhnikov.substack.com/p/exposing-kubernetes-dual-haproxy
MemOps🤨
В облачных средах эта проблема обычно решается с помощью управляемого балансировщика нагрузки. В самодельной настройке Proxmox нам нужен эквивалентный компонент, который находится на границе между публичной сетью и частной сетью кластера. Здесь эту роль выполняет HAProxy.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
Substack
Exposing Kubernetes: Dual HAProxy Setup on Proxmox & Ingress Controller
(64GB RAM Kubernetes Cluster for €39/month — Part 5)
Отладка процессов между границами контейнеров в Kubernetes
📌 Подробнее: https://www.enterprisedb.com/blog/debugging-processes-across-container-boundaries-kubernetes
MemOps🤨
К счастью, в Kubernetes обновления функции эфемерных контейнеров и добавление опций --profile и --target к команде kubectl debug значительно упростили этот процесс. Теперь существует довольно простой способ создания привилегированного контекста процесса, который разделяет пространство имен pid с конкретным целевым контейнером.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
EDB
Debugging processes across container boundaries on Kubernetes
Debugging software in a con
Luxury yacht — кроссплатформенное графическое настольное приложение для управления кластерами и ресурсами Kubernetes.
📌 Подробнее: https://github.com/luxury-yacht/app
MemOps🤨
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - luxury-yacht/app: Luxury Yacht - A cross-platform app for managing Kubernetes clusters and resources
Luxury Yacht - A cross-platform app for managing Kubernetes clusters and resources - luxury-yacht/app
Сколько незаконченных Git-репозиториев лежит у вас на диске?
- где остались незакоммиченные изменения;
- какие коммиты ещё не отправлены;
- где забыты
- какие проекты изменились после последнего тега и готовы к новому релизу.
Инструмент проверяет не только текущую ветку, поэтому забытая работа в локальной feature-ветке тоже попадёт в список.
После установки достаточно запустить:
Есть фильтры, fuzzy-поиск, JSON-вывод, открытие проекта в редакторе и массовый fetch. Состояние репозиториев обновляется автоматически через файловый watcher.
drydock написан на Rust с использованием Ratatui и работает на macOS и Linux.
Полезная утилита для разработчиков, у которых папка Projects давно превратилась в кладбище почти законченных идей.
📌 Подробнее: https://github.com/yetidevworks/drydock
MemOps🤨
drydock показывает их все в одном терминальном интерфейсе:- где остались незакоммиченные изменения;
- какие коммиты ещё не отправлены;
- где забыты
stash, конфликт или незавершённый rebase;- какие проекты изменились после последнего тега и готовы к новому релизу.
Инструмент проверяет не только текущую ветку, поэтому забытая работа в локальной feature-ветке тоже попадёт в список.
brew install yetidevworks/drydock/drydock
# или
cargo install drydock
После установки достаточно запустить:
drydock
Есть фильтры, fuzzy-поиск, JSON-вывод, открытие проекта в редакторе и массовый fetch. Состояние репозиториев обновляется автоматически через файловый watcher.
drydock написан на Rust с использованием Ratatui и работает на macOS и Linux.
Полезная утилита для разработчиков, у которых папка Projects давно превратилась в кладбище почти законченных идей.
📌 Подробнее: https://github.com/yetidevworks/drydock
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
😁4👍1
piqc показывает, сколько денег Kubernetes-кластер теряет на простаивающих GPU
Команды часто видят загрузку GPU, но не понимают:
- какая модель работает на конкретном ускорителе;
- сколько стоит генерация токенов;
- где простаивает железо;
- почему растёт инфраструктурный счёт.
piqc сканирует Kubernetes-кластер и автоматически находит inference-нагрузки на vLLM и Ray Serve.
Инструмент связывает между собой модели, GPU, реплики и runtime-метрики, а затем формирует отчёт о расходах и неэффективном использовании ресурсов.
Что умеет находить piqc:
- простаивающие GPU;
- модели на слишком дорогих ускорителях;
- полностью свободные GPU-узлы;
- фрагментацию ресурсов;
- зависшие в очереди поды;
- низкую эффективность вычислений;
- завышенную стоимость генерации токенов.
Для vLLM также собираются:
- latency;
- скорость prefill и генерации;
- загрузка KV-cache;
- глубина очереди;
- состояние inference-сервиса.
Быстрый запуск:
Результаты можно получить в форматах table, JSON, YAML или в виде стандартизированного facts bundle.
Инструмент также запускается внутри кластера как Kubernetes Job - без постоянных агентов и sidecar-контейнеров.
Важная деталь: сейчас проект распространяется по Business Source License 1.1. Переход на Apache 2.0 запланирован на 2028 год.
По сути, piqc отвечает на вопрос, который обычный мониторинг часто оставляет без ответа:
какая именно модель сжигает GPU-бюджет и почему?
📌 Подробнее: https://github.com/paralleliq/piqc
MemOps🤨
Команды часто видят загрузку GPU, но не понимают:
- какая модель работает на конкретном ускорителе;
- сколько стоит генерация токенов;
- где простаивает железо;
- почему растёт инфраструктурный счёт.
piqc сканирует Kubernetes-кластер и автоматически находит inference-нагрузки на vLLM и Ray Serve.
Инструмент связывает между собой модели, GPU, реплики и runtime-метрики, а затем формирует отчёт о расходах и неэффективном использовании ресурсов.
Что умеет находить piqc:
- простаивающие GPU;
- модели на слишком дорогих ускорителях;
- полностью свободные GPU-узлы;
- фрагментацию ресурсов;
- зависшие в очереди поды;
- низкую эффективность вычислений;
- завышенную стоимость генерации токенов.
Для vLLM также собираются:
- latency;
- скорость prefill и генерации;
- загрузка KV-cache;
- глубина очереди;
- состояние inference-сервиса.
Быстрый запуск:
pipx install piqc
piqc scan --format table
Результаты можно получить в форматах table, JSON, YAML или в виде стандартизированного facts bundle.
Инструмент также запускается внутри кластера как Kubernetes Job - без постоянных агентов и sidecar-контейнеров.
Важная деталь: сейчас проект распространяется по Business Source License 1.1. Переход на Apache 2.0 запланирован на 2028 год.
По сути, piqc отвечает на вопрос, который обычный мониторинг часто оставляет без ответа:
какая именно модель сжигает GPU-бюджет и почему?
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - paralleliq/piqc: Kubernetes scanner that discovers LLMs running on vLLM and extracts their deployment and runtime facts.
Kubernetes scanner that discovers LLMs running on vLLM and extracts their deployment and runtime facts. - paralleliq/piqc
❤4
How to visualize workflows and business processes in Grafana: Introducing the Graphviz panel
Grafana постепенно превращается в инструмент, где можно показать как система или бизнес-процесс устроены целиком.
Виджет Graphviz позволяет описывать карты сервисов, payment flow, CI/CD-пайплайны, сетевые карты и ранбуки через DOT-синтаксис — без ручного перетаскивания десятков блоков.
А главное, цвета узлов, подписи и связи можно привязать к живым метрикам и запросам. Схема может строиться прямо из данных: в помощь Service registry, Terraform state или Kubernetes-топология.
Старый вопрос «а можно в Grafana сделать нормальную карту сервисов?» наконец получает ответ.
📌 Подробнее: https://grafana.com/blog/how-to-visualize-workflows-and-business-processes-in-grafana-introducing-the-graphviz-panel/
📌 https://grafana.com/grafana/plugins/grafana-graphviz-panel/?pg=how-to-visualize-workflows-and-business-processes-in-grafana-introducing-the-graphviz-panel
MemOps🤨
Grafana постепенно превращается в инструмент, где можно показать как система или бизнес-процесс устроены целиком.
Виджет Graphviz позволяет описывать карты сервисов, payment flow, CI/CD-пайплайны, сетевые карты и ранбуки через DOT-синтаксис — без ручного перетаскивания десятков блоков.
А главное, цвета узлов, подписи и связи можно привязать к живым метрикам и запросам. Схема может строиться прямо из данных: в помощь Service registry, Terraform state или Kubernetes-топология.
Старый вопрос «а можно в Grafana сделать нормальную карту сервисов?» наконец получает ответ.
MemOps
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4