KazDevOps
6.88K subscribers
1.64K photos
27 videos
21 files
1.54K links
Канал о DevOps во всех проявлениях: K8s, CI/CD, HighLoad, AI/ML, Cloud, Linux
Возьмем на поддержку DevOps: https://core247.kz/
По рекламе @UlKonovalova
Download Telegram
⚡️ Блог Ибэшника, который ведёт человек с 15-ти летним стажем работы

В канале он рассказывает:

🟢Какими инструментами он пользуется при работе
🟢Какими законными и подзаконными актами он руководствуется
🟢Как правильно делать обращения в ФСТЭК
🟢Так же рассказывает о инцидентах, с которыми встречается при работе

👈 Карманный хакер — ваш путеводитель в мир ИБ
Please open Telegram to view this post
VIEW IN TELEGRAM
12222
⚡️ Каналы для вашего развития в IT и DevOps

Рекомендуем качественный контент знакомого ИТ-сообщества с 15-летним стажем:

⚪️ ITKB_channel (в MAX 📲 IT-KB) — бесплатное обучение по Windows, Linux, DevOps, Security, Network, программированию.

⚪️ ITKB_Archive — цифровая библиотека (книги, курсы, ИТ литература по Windows, Linux, сети, программирование, Project, DevOps)
Please open Telegram to view this post
VIEW IN TELEGRAM
55532
🔥 Работа для DevOps в Европе и США

Запросы на работу заграницей актуальны всегда, ведь при том же уровне знаний можно претендовать на рост ЗП x2 и даже х3. При этом работать можно удалённо и не переезжать вовсе.

Международный рынок открыт, но нужны правильный стек, понятное резюме, хороший английский и умение проходить технические интервью по западным стандартам. Хорошая новость: всё это можно освоить. Подготовили для вас 2 статьи, которые можно смело забирать в закладки и использовать как руководства к действию.

1. Как найти работу в Европе в 2026 году: полный пошаговый гайд
2. Как IT-специалисту перейти в международную компанию

Узнаете:

⚪️ личный опыт рекрутера по поиску работы для DevOps
⚪️ кого сейчас ищут международные работодатели
⚪️ где искать вакансии и стажировки
⚪️ как готовиться к собеседованиям
⚪️ какие навыки стоит подтянуть
⚪️ где учиться навыкам, которых пока не хватает

@DevOpsKaz 😛
Please open Telegram to view this post
VIEW IN TELEGRAM
1953
🔥 HAMi: виртуализация ускорителей (GPU, NPU) вошла в CNCF Incubator

Проблема, которую закрывает проект, знакома всем, кто выкатывал ML-нагрузки в k8s: один под забирает целый ускоритель, утилизация 10-20%, а очередь на GPU растёт. HAMi позволяет «нарезать» физический GPU или NPU на доли с жёсткой изоляцией по вычислениям и памяти, размещая несколько контейнеров на одной карте.

HAMi — это инструмент, который позволяет выжать максимум из железа без переписывания кода приложений и изменения манифестов Kubernetes.

Архитектурно это device plugin плюс несколько компонентов. Mutating Webhook перехватывает создание подов и переписывает запросы ресурсов. Scheduler Extender фильтрует ноды и раскладывает поды по политикам размещения. Device Plugins регистрируют ускорители и выдают их доли контейнерам. HAMi-Core — слой виртуализации, который держит жёсткие лимиты. HAMi-WebUI даёт интерфейс управления и метрики в Prometheus и Grafana.

Для платформенной команды это перевод дорогого железа из режима «одна карта - одна задача» в нормальный SLO по утилизации, без переписывания приложений и без vendor lock-in на конкретный стек.


В планах команды : продвинутый шедулинг, поддержка DRA и расширение списка ускорителей. Для тех, кто выбирает базу под inference-платформу на 2026-2027, это уже кандидат для PoC рядом с NVIDIA GPU Operator и MIG.

@DevOpsKaz 😛
Please open Telegram to view this post
VIEW IN TELEGRAM
4321
⚡️ Развилка для тимлида: проверьте себя за 30 секунд

Ситуация: единственный человек, который знает платежный модуль, увольняется через две недели. Прод-диск зашифрован по требованию HIPAA, пароль только у него в голове.


Ваш ход:

a) Посадить дублера в пару и сразу перенести доступы в общее хранилище
b) Заказать подробную документацию по модулю
c) Заморозить вопрос: сейчас релиз, потом разберемся

Прежде чем читать дальше, выберите вариант.

Как ответило сообщество тимлидов Казахстана: 58% за a, 30% за b, 12% за c.

Аргумент против документации, который там прозвучал: док опишет «что», но не «почему». А пароль в документ не запишешь, он все еще в чужой голове.

Это один из 25 сценариев тимлид-симулятора на teamleads.kz. Кейсы собраны из реальных споров в чате, поэтому проценты под каждым вариантом — реальные ответы людей. Каждый сценарий заканчивается ссылкой на обсуждение, из которого он вырос.

Что там есть на наши темы:

⚪️ Джун впервые уронил прод и стоит рядом с трясущимися руками. Чинить самому или дать чинить ему под присмотром
⚪️ Автономные development loops: инженер хочет попробовать, один прогон большой задачи жжет 100+ долларов за вечер, заказчик смотрит на бюджеты
⚪️ Ваншот-утилита, написанная с LLM за вечер, потихоньку стала нагруженной и от нее зависят другие
⚪️ Систем-дизайн интервью, где на вопрос про нагрузку и SLA отвечают «жестких требований нет, лимитов нет»
⚪️ Новая модель обошла вашего фаворита в публичных лидербордах, команда просит перевести на нее агентские пайплайны

👈 Запустить в браузере (регистрация не нужна)

Чат сообщества: @teamleads_kz

@DevOpsKaz 😛
Please open Telegram to view this post
VIEW IN TELEGRAM
1433
🔥 Новости мира DevOps, которые вы могли пропустить

⚪️ Cloud Native Buildpacks получил статус Graduated-проекта в CNCF

Технология, созданная Pivotal и Heroku еще в 2018 году, официально завершила инкубационный период. Инструмент, позволяющий трансформировать исходный код приложений в готовые OCI-контейнеры без написания Dockerfile, уже давно стал стандартом де-факто для таких гигантов, как Google, Microsoft, Bloomberg и VMware.

⚪️ Google проектирует серверный ИИ-чип Frozen v2 под архитектуру Gemini.

Компания планирует «зашить» ключевые элементы своей LLM прямо в кремний. Ожидается, что аппаратная фиксация архитектуры даст рост энергоэффективности в 6–10 раз по сравнению с текущими TPU. Главная плата за такой буст — потеря гибкости: любое радикальное изменение в будущих версиях Gemini потребует проектирования нового чипа. Развертывание ожидается с 2028 года.

⚪️ Kelos — фреймворк для запуска AI-агентов как нативных ресурсов Kubernetes

Проект предлагает уйти от локального запуска кодинг-агентов в терминале и превратить их в часть control plane. Kelos добавляет в K8s набор CRD (Task, Session, TaskSpawner), позволяя описывать воркфлоу агентов декларативно, изолировать их в подах с лимитами ресурсов, подключать MCP-серверы и автоматически генерировать PR прямо из GitHub Issues или Jira по принципам GitOps.

⚪️ Containerlab — фокус на тестировании сетевых топологий в контейнерах

Полезный опенсорсный инструмент для сетевых инженеров и DevOps-специалистов. Проект позволяет быстро разворачивать и оркестровать контейнеризированные сетевые операционные системы (Network OS) для проверки фич, валидации дизайнов и проведения интеграционных тестов инфраструктуры прямо на локальной машине или в CI/CD.

@DevOpsKaz 😛
Please open Telegram to view this post
VIEW IN TELEGRAM
1543
🔥 Крутые каналы для IT-специалистов

⚙️ Dev Boost — огромная коллекция платных курсов, которые можно скачать бесплатно

👩‍💻 IT Books — огромная библиотека книг

💻 Hacking & InfoSec Base — крутой блог белого хакера

🛡 CyberGuard — всё про ИБ

🤔 ИБ Вакансии — всё, чтобы найти работу в ИБ

👩‍💻 linux administration — всё про Линукс

👩‍💻 Программистика — python, python и ещё раз python

👩‍💻 GameDev Base — всё про GameDev

😆 //code — топовые мемы по IT
Please open Telegram to view this post
VIEW IN TELEGRAM
14432
Please open Telegram to view this post
VIEW IN TELEGRAM
143322
🔥 Разбор собеседования в Netflix: Senior DevOps / SRE

Подборка реальных вопросов с интервью в Netflix. Направление — масштабируемые системы, отладка на стыке сети и ядра, а также культура хаос-инжиниринга.

⚪️ Round 1 — Systems at Scale, K8s, Cloud & Linux

- Service Discovery: как реализовать гранулярный discovery на 1000+ микросервисов с помощью Envoy или Istio без просадки по перформансу?
- eBPF & Cilium: как с помощью eBPF + Cilium раскатывать network security policies в runtime? В чём профит по сравнению с классическими CNI?
- Multi-Cloud: у Netflix мультиоблачная инфраструктура. Опишите свой подход к кросс-облачному роутингу, управления IAM и синхронизации секретов.
- Troubleshooting: периодически фейлятся systemd-юниты на нодах EKS. Как детектить такие плавающие баги и авто-хилить ноды?
- Golden Images: продуктовые команды просят кастомные AMI. Какую стратегию проверок на уровне ядра и runtime вы внедрите перед продом?
- Kube-probes: продвинутый конфиг liveness/readiness проб в K8s. Как детектить сбои бизнес-логики, если приложения продолжают отдавать 200 OK?
- DNS & Mesh: как справиться с DNS-аутом внутри Service Mesh без полного передеплоя сервисов?
- IaC Incident: бэкенд remote_state в Terraform неожиданно упал по таймауту. Ваш план по восстановлению и локализации ущерба?


⚪️ Round 2 — RCA, Fire Drills & Netflix-Scale Chaos

- mTLS Failure: раскатка нового конфига Envoy незаметно сломала mTLS между edge-слоем и мешем. Как будете строить цепочку RCA (Root Cause Analysis)?
- HPA Stalls: HPA отказывается масштабировать поды, хотя Prometheus показывает CPU > 80%. Пошаговый диагноз с упором на метрики облака и K8s.
- Sidecar Latency: добавили sidecar-кэш для ускорения, но неожиданно подскочил tail latency (p99). Каков ваш план отладки?
- Ghost Outage: ошибки 504 на сервисе воспроизведения. Cloud Load Balancer показывает Healthy, сайдкары в меше зелёные, но видео у юзеров не стримится. Где искать затык?
- FinOps Anomaly: резко выросли расходы на NAT Gateway. При этом релизов и изменений инфры на этой неделе не было. Что могло незаметно вызвать такой спайк?


⚪️ Round 3 — Leadership, Chaos Culture & Engineering Influence

- SRE-культура: как построить инженерную культуру, в которой продуктовые команды реально владеют своими SLO, а не просто игнорируют их?
- Extreme Delivery: нужно задизайнить мультирегиональный фейловер за 3 недели, при этом менять DNS-слой запрещено. Ваш план?
- Release Prep: как спроектировать и провести хаос-тестирование деградации инфры перед премьерой супер-релиза уровня Netflix Originals?
- Exec Pitch: как доказать бизнесу и нетехническим топ-менеджерам реальный ROI от модернизации инфраструктуры?


@DevOpsKaz 😛
Please open Telegram to view this post
VIEW IN TELEGRAM
197
🔥 Не знаете, куда сходить, чтобы прокачаться в профессии?

Наши друзья из «Стартап-Чайханы» ежедневно собирают актуальные мероприятия, дедлайны и возможности для стартаперов, IT-специалистов и предпринимателей Центральной Азии.

В канале можно найти конференции, митапы, хакатоны, акселераторы, гранты, конкурсы и образовательные программы — всё в одном месте, без долгих поисков.

👈 Подписывайтесь на «Стартап-Чайхану», чтобы не пропускать полезные события и новые возможности
Please open Telegram to view this post
VIEW IN TELEGRAM
14332
Forwarded from DevOpsDays Almaty 2026
☄️ Get over here! ☄️

Несмертельной схватке за стабильный прод — быть! DevOpsDays Almaty'26 с новой концепцией в духе Mortal Kombat стартует 16 октября 2026.

Это наша юбилейная, 5-ая конференция в Алматы, которая объединит DevOps-ов, хостеров, вендоров ПО, банки, телеком-компании, СМИ и новичков в IT под крышей арены.

Будем делать фаталити всем сломанным процессам, упавшим серверам и кривому коду. В этому году еще больше программа, еще больше гостей. На конференции вас ждут:

— Доклады от мастеров-экспертов
— Фантастические инсайды с рынка DevOps
— Опенспейсы для дискуссий вне битв
— Воркшопы, которые бустанут ваши навыки на поле битвы
— Нетворкинг с комьюнити — Саб-Зиро и Шан Сунгом
— Мерч и подарки от партнеров

🎟 FINISH THEM! Скидки для Early Birds

Первая волна билетов уже в продаже по самой горячей цене. Количество мест ограничено — пройдут только достойные.

@devopsdayskz
Please open Telegram to view this post
VIEW IN TELEGRAM
1433
🔥 Бесплатный интенсив по ИИ и аналитике — 4 августа

Интенсив подойдет как новичкам, так и тем, кто уже знаком с ИИ и аналитикой.

Во время интенсива вас ждут:

⚪️ 2 дня обучения + бонусный день
⚪️ личный наставник
⚪️ поддержка в WhatsApp-чате
⚪️ прямые эфиры с Екатериной Рехерт
⚪️ мини-курс в подарок.

По окончании обучения вы получите именной сертификат от одной из крупнейших IT-школ Казахстана DataBoom.

За 7 лет DataBoom обучили 27 000+ студентов, провели 230+ потоков обучения, помогли 1 000+ выпускникам получить международные сертификаты Microsoft и стали образовательным партнером для 500+ компаний.

Программа разработана Екатериной Рехерт — основательницей DataBoom, главным методологом и автором образовательных программ школы, единственной в Казахстане обладательницей статуса Microsoft Most Valuable Professional в области Data & AI.


👈 Зарегистрироваться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1222
⚡️ Почему продукты проваливаются на этапе масштабирования

Распространенный паттерн при цифровой трансформации — фокус на внедрении новых технологий (включая ИИ) в ущерб системному фундаменту. В результате организация получает фрагментированные сервисы, которые увеличивают технический долг и не дают ожидаемого бизнес-эффекта.

Настоящая модернизация начинается с определения проблемы. Устойчивый технический фундамент строится на 3 неразрывных уровнях:

1️⃣ Architecture-First (единый блюпринт)

До старта разработки фиксируются правила: как системы связываются между собой, где хранятся данные, как встраивается ИИ и где проходят границы. Без единого архитектурного блюпринта команды начинают модернизировать сервисы в изоляции, воссоздавая ту самую фрагментацию, от которой пытались уйти.

2️⃣ API-First (границы возможностей и соединительная ткань)

API служат не просто интеграционными точками, а жесткими границами между функциональными возможностями системы. Подход API-first создает разделение слоев: бэкенд может эволюционировать, рефакториться или меняться технологически без нарушения работы интерфейсов и без необходимости перестраивать нижележащие системы.

3️⃣ Experience Layer (мост между UX и бизнес-процессами)

Слой пользовательского опыта связывает продуктовые интерфейсы с бизнес-процессами. Он строится на 2 принципах: адаптивности (персонализация под разные роли и контексты) и элегантности дизайна (выполнение задач без трения). Доказательство качества этого слоя — метрика voluntary adoption (добровольное использование продукта).

Итоговая матрица взаимосвязи:

⚪️ Архитектура дает единый чертеж и предотвращает фрагментацию
⚪️ API задают границы и обеспечивают независимость эволюции бэкенда и фронтенда
⚪️ Experience Layer обеспечивает конверсию технической базы в пользовательское признание и бизнес-ценность

Игнорирование любого из этих уровней ведет либо к созданию дорогостоящей инфраструктуры, либо к архитектурному тупику при попытке масштабирования.


@DevOpsKaz 😛
Please open Telegram to view this post
VIEW IN TELEGRAM
222
⚡️ Как управлять инфраструктурой на 80 млн юзеров командой из 5 человек

Разработчики популярного социальной платформы Yubo поделились выпуском серии статей, в которых подробно рассказали, как небольшой команде удается поддерживать и развивать масштабную cloud-native инфраструктуру.


Собрали для вас полную подборку всех частей с кратким обзором ключевых тем:

⚪️ Часть 1. Введение в инфраструктуру Yubo: Обзор и философия

В первой части авторы описывают общую архитектуру Yubo и философский подход к проектированию систем. Вы узнаете, как принципы утилитарности, минимализма и ставка на облачные решения позволяют крошечной команде справляться с огромной нагрузкой.

⚪️ Часть 2. Структура команды и роли: Data Engineers, DevOps и Security

Разбор внутреннего устройства команды: распределение задач между дата-инженерами, DevOps-специалистами и экспертами по безопасности. Статья раскрывает, как перекрестное обучение и четкая зона ответственности помогают избежать узких мест в работе.

⚪️ Часть 3. Инженерия данных на масштабе и Self-Service базы данных

Эта часть про то, как устроена работа с пайплайнами данных и хранилищами под миллионы пользователей. Авторы объясняют, как концепция селф-сервиса позволяет продуктовым командам самостоятельно работать с базами данных без привлечения инфраструктурных инженеров.

⚪️ Часть 4. Автоматизация на масштабе

Главный секрет эффективной работы маленькой команды — это максимальная автоматизация рутины. Вы узнаете про Infrastructure as Code, автомасштабирование и инструменты CI/CD, минимизирующие человеческий фактор.

⚪️ Часть 5. Облачный MLOps

Финальная часть серии о том, как в Yubo разворачивают и поддерживают модели машинного обучения в продакшене. Авторы делятся опытом построения облачного MLOps-конвейера для модерации контента и работы рекомендательных систем в реальном времени.

@DevOpsKaz 😛
Please open Telegram to view this post
VIEW IN TELEGRAM
14322
⚡️ PROFIT Industry & Energy Day — в Астане 27 августа

Приглашение для казахстанских промышленных и энергетических компаний на конференцию PROFIT Industry & Energy Day.

Эффективное управление, сбор и обработка информации, внедрение технологий на производственных этапах — во всех этих вопросах ИТ играют ключевую роль.

На конференции PROFIT Industry & Energy Day обсудят:

⚪️ Какие решения используются в казахстанской промышленности?
⚪️ Как оптимизировать расходы и развивать предприятие с использованием новых технологий?
⚪️ Какие преграды стоят на пути Индустрии 4.0 в стране?

👈 Регистрация открыта

@DevOpsKaz 😛
Please open Telegram to view this post
VIEW IN TELEGRAM
222
🔥 Новости мира DevOps, которые вы могли пропустить

⚪️ Wave — контроллер для автоматического отслеживания изменений конфигураций в Kubernetes

Инструмент решает вечную проблему с обновлением ConfigMap и Secrets. Wave мониторит монтируемые конфиги для Deployments, StatefulSets и DaemonSets и автоматически запускает Rolling Update подов при изменении данных. Никаких ручных рестартов или костылей с добавлением хешей в аннотации.

⚪️ Sveltos — контроллер для управления аддонами и приложениями на мультикластерных фермах

Проект не конкурирует с ArgoCD или Flux, а расширяет их возможности. Sveltos позволяет раскатывать манифесты и Helm-чарты по множеству кластеров на основе меток (label-based matching). Конфигурации кластерно-независимы: достаточно повесить нужный label на новый кластер, и Sveltos сам доставит туда требуемый стек.

⚪️ Обновление опенсорс-платформы для подготовки к экзаменам по Kubernetes

Бесплатный практический тренажер для подготовки к CKA, CKAD и CKS продолжает активно развиваться. В проект добавили полноценный курс и практические лабораторные работы для подготовки к сертификации Istio Certified Associate (ICA). Отличный вариант, чтобы подтянуть знания по Service Mesh на практике.

⚪️ В Istio появился новый TrafficExtension API для кастомизации Envoy

API объединяет управление расширениями на базе WebAssembly (Wasm) и Lua в едином интерфейсе. Раньше для Lua приходилось использовать сложный и хрупкий EnvoyFilter. Новый декларативный подход одинаково работает с сайдкарами, шлюзами и waypoint-прокси (в Ambient Mode), упрощая миграцию и кастомизацию data plane.

@DevOpsKaz 😛
Please open Telegram to view this post
VIEW IN TELEGRAM
433
⚡️ 10 дней до старта Cloud Native Community Day

Уже 13 августа мы встретимся в Almaty Hub большой компанией, чтобы вместе продвинуться в понимании cloud native, разрешить спорные вопросы и найти подход к проблемам. Подготовили насыщенную программу — и ждем только вас. Торопитесь зарегаться, так как места ограничены.

👈 Зарегистрироваться как участник

А пока напоминаем, какой контент вас ждет.

⚪️ Иван Екимов, SUSE: «Как скрыть control plane k8s и что это дает»
Managed-платформа должна автоматически создавать, масштабировать, обновлять и сопровождать кластеры на протяжении всего жизненного цикла. Для реализации такого подхода наиболее подходит Cluster API — благодаря декларативной модели управления и поддержке различных инфраструктур.


⚪️ Максат Акбанов, Magnum Cash&Carry: «Защита Kubernetes-кластера с помощью Kubescape»
Обзор возможностей DevSecOps-инструмента Kubescape (CNCF) и опыт внедрения в релизные циклы. Узнаете про статический и динамический режимы работы, генерацию отчетов безопасности, интеграцию с ArgoCD, настройку Alertmanager и мониторинг безопасности через Prometheus exporter.


⚪️ Эмиль Аминов, Cloud Tech Lead, Salmon: «За пределами одного кластера: Istio Multi-Cluster между AWS-аккаунтами»
Как построить Istio Multi-Cluster между несколькими AWS-аккаунтами, связать распределённые сервисы и какие архитектурные решения помогают масштабировать облачную платформу.


⚪️ Валерий Окшин, DevOps Team Lead, Freedom Cloud: «Longhorn: когда Ceph слишком тяжёл, а local storage уже не хватает»
Когда Longhorn становится оптимальным выбором для Kubernetes, какие задачи он решает и какие компромиссы стоит учитывать при эксплуатации.


⚪️ Тимур Тукаев, COO из Aenix: «Kubernetes как Linux Kernel: какое будущее ждет самый популярный оркестратор»
Сегодня K8s воспринимается как готовое приложение, иногда даже как «ОС для облаков». Это тупик. Kubernetes должен превратиться в аналог Linux Kernel — низкоуровневый компонент, с которым работает очень ограниченное людей.


👈 Зарегистрироваться как участник

Также мы проведем воркшоп (регистрируйтесь на сам ивент и отдельно на воркшоп), где разберем, как перейти от классической виртуализации к cloud native private cloud: с виртуальными машинами, self-service для команд, managed-сервисами, сетями, хранилищем, мониторингом и API-first подходом.

@DevOpsKaz 😛
Please open Telegram to view this post
VIEW IN TELEGRAM
1433