Forwarded from DevOpsDays Almaty 2026
Несмертельной схватке за стабильный прод — быть! DevOpsDays Almaty'26 с новой концепцией в духе Mortal Kombat стартует 16 октября 2026.
Это наша юбилейная, 5-ая конференция в Алматы, которая объединит DevOps-ов, хостеров, вендоров ПО, банки, телеком-компании, СМИ и новичков в IT под крышей арены.
Будем делать фаталити всем сломанным процессам, упавшим серверам и кривому коду. В этому году еще больше программа, еще больше гостей. На конференции вас ждут:
— Доклады от мастеров-экспертов
— Фантастические инсайды с рынка DevOps
— Опенспейсы для дискуссий вне битв
— Воркшопы, которые бустанут ваши навыки на поле битвы
— Нетворкинг с комьюнити —
— Мерч и подарки от партнеров
🎟 FINISH THEM! Скидки для Early Birds
Первая волна билетов уже в продаже по самой горячей цене. Количество мест ограничено — пройдут только достойные.
@devopsdayskz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4 3 3
Интенсив подойдет как новичкам, так и тем, кто уже знаком с ИИ и аналитикой.
Во время интенсива вас ждут:
По окончании обучения вы получите именной сертификат от одной из крупнейших IT-школ Казахстана DataBoom.
За 7 лет DataBoom обучили 27 000+ студентов, провели 230+ потоков обучения, помогли 1 000+ выпускникам получить международные сертификаты Microsoft и стали образовательным партнером для 500+ компаний.
Программа разработана Екатериной Рехерт — основательницей DataBoom, главным методологом и автором образовательных программ школы, единственной в Казахстане обладательницей статуса Microsoft Most Valuable Professional в области Data & AI.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1 2 2 2
Распространенный паттерн при цифровой трансформации — фокус на внедрении новых технологий (включая ИИ) в ущерб системному фундаменту. В результате организация получает фрагментированные сервисы, которые увеличивают технический долг и не дают ожидаемого бизнес-эффекта.
Настоящая модернизация начинается с определения проблемы. Устойчивый технический фундамент строится на 3 неразрывных уровнях:
До старта разработки фиксируются правила: как системы связываются между собой, где хранятся данные, как встраивается ИИ и где проходят границы. Без единого архитектурного блюпринта команды начинают модернизировать сервисы в изоляции, воссоздавая ту самую фрагментацию, от которой пытались уйти.
API служат не просто интеграционными точками, а жесткими границами между функциональными возможностями системы. Подход API-first создает разделение слоев: бэкенд может эволюционировать, рефакториться или меняться технологически без нарушения работы интерфейсов и без необходимости перестраивать нижележащие системы.
Слой пользовательского опыта связывает продуктовые интерфейсы с бизнес-процессами. Он строится на 2 принципах: адаптивности (персонализация под разные роли и контексты) и элегантности дизайна (выполнение задач без трения). Доказательство качества этого слоя — метрика voluntary adoption (добровольное использование продукта).
Итоговая матрица взаимосвязи:
Игнорирование любого из этих уровней ведет либо к созданию дорогостоящей инфраструктуры, либо к архитектурному тупику при попытке масштабирования.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
Разработчики популярного социальной платформы Yubo поделились выпуском серии статей, в которых подробно рассказали, как небольшой команде удается поддерживать и развивать масштабную cloud-native инфраструктуру.
Собрали для вас полную подборку всех частей с кратким обзором ключевых тем:
В первой части авторы описывают общую архитектуру Yubo и философский подход к проектированию систем. Вы узнаете, как принципы утилитарности, минимализма и ставка на облачные решения позволяют крошечной команде справляться с огромной нагрузкой.
Разбор внутреннего устройства команды: распределение задач между дата-инженерами, DevOps-специалистами и экспертами по безопасности. Статья раскрывает, как перекрестное обучение и четкая зона ответственности помогают избежать узких мест в работе.
Эта часть про то, как устроена работа с пайплайнами данных и хранилищами под миллионы пользователей. Авторы объясняют, как концепция селф-сервиса позволяет продуктовым командам самостоятельно работать с базами данных без привлечения инфраструктурных инженеров.
Главный секрет эффективной работы маленькой команды — это максимальная автоматизация рутины. Вы узнаете про Infrastructure as Code, автомасштабирование и инструменты CI/CD, минимизирующие человеческий фактор.
Финальная часть серии о том, как в Yubo разворачивают и поддерживают модели машинного обучения в продакшене. Авторы делятся опытом построения облачного MLOps-конвейера для модерации контента и работы рекомендательных систем в реальном времени.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4 3 2 2
Приглашение для казахстанских промышленных и энергетических компаний на конференцию PROFIT Industry & Energy Day.
Эффективное управление, сбор и обработка информации, внедрение технологий на производственных этапах — во всех этих вопросах ИТ играют ключевую роль.
На конференции PROFIT Industry & Energy Day обсудят:
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
Инструмент решает вечную проблему с обновлением ConfigMap и Secrets. Wave мониторит монтируемые конфиги для Deployments, StatefulSets и DaemonSets и автоматически запускает Rolling Update подов при изменении данных. Никаких ручных рестартов или костылей с добавлением хешей в аннотации.
Проект не конкурирует с ArgoCD или Flux, а расширяет их возможности. Sveltos позволяет раскатывать манифесты и Helm-чарты по множеству кластеров на основе меток (label-based matching). Конфигурации кластерно-независимы: достаточно повесить нужный label на новый кластер, и Sveltos сам доставит туда требуемый стек.
Бесплатный практический тренажер для подготовки к CKA, CKAD и CKS продолжает активно развиваться. В проект добавили полноценный курс и практические лабораторные работы для подготовки к сертификации Istio Certified Associate (ICA). Отличный вариант, чтобы подтянуть знания по Service Mesh на практике.
API объединяет управление расширениями на базе WebAssembly (Wasm) и Lua в едином интерфейсе. Раньше для Lua приходилось использовать сложный и хрупкий EnvoyFilter. Новый декларативный подход одинаково работает с сайдкарами, шлюзами и waypoint-прокси (в Ambient Mode), упрощая миграцию и кастомизацию data plane.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
Уже 13 августа мы встретимся в Almaty Hub большой компанией, чтобы вместе продвинуться в понимании cloud native, разрешить спорные вопросы и найти подход к проблемам. Подготовили насыщенную программу — и ждем только вас. Торопитесь зарегаться, так как места ограничены.
А пока напоминаем, какой контент вас ждет.
Managed-платформа должна автоматически создавать, масштабировать, обновлять и сопровождать кластеры на протяжении всего жизненного цикла. Для реализации такого подхода наиболее подходит Cluster API — благодаря декларативной модели управления и поддержке различных инфраструктур.
Обзор возможностей DevSecOps-инструмента Kubescape (CNCF) и опыт внедрения в релизные циклы. Узнаете про статический и динамический режимы работы, генерацию отчетов безопасности, интеграцию с ArgoCD, настройку Alertmanager и мониторинг безопасности через Prometheus exporter.
Как построить Istio Multi-Cluster между несколькими AWS-аккаунтами, связать распределённые сервисы и какие архитектурные решения помогают масштабировать облачную платформу.
Когда Longhorn становится оптимальным выбором для Kubernetes, какие задачи он решает и какие компромиссы стоит учитывать при эксплуатации.
Сегодня K8s воспринимается как готовое приложение, иногда даже как «ОС для облаков». Это тупик. Kubernetes должен превратиться в аналог Linux Kernel — низкоуровневый компонент, с которым работает очень ограниченное людей.
Также мы проведем воркшоп (регистрируйтесь на сам ивент и отдельно на воркшоп), где разберем, как перейти от классической виртуализации к cloud native private cloud: с виртуальными машинами, self-service для команд, managed-сервисами, сетями, хранилищем, мониторингом и API-first подходом.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4 3 3
Представляем Ministack — сервис с 60+ эмулируемых AWS-сервисов на одном порту: S3, SQS, SNS, DynamoDB, Lambda, Secrets Manager, Step Functions, CloudWatch и другие. Совместим с Terraform.
Он предназначен для локальной разработки, интеграционного тестирования и запуска в CI/CD без необходимости реального обращения к AWS и оплаты ресурсов.
Для ряда сервисов поднимаются честные контейнеры/движки — RDS запускает настоящие Postgres/MySQL, ElastiCache — Redis/Valkey, Athena использует DuckDB, а ECS — Docker API.
Есть встроенные эндпоинты для автоматизации тестов. В отличие от стандартного AWS API, Ministack предоставляет служебные URI для быстрого управления состоянием в автотестах.
Образ занимает всего ~270 MB (против ~1 GB у LocalStack), а потребление RAM в idle — около ~30 MB (против ~500 MB).
Хороший выбор для DevOps-инженеров, которым нужно быстрое, воспроизводимое и легковесное окружение «здесь и сейчас», не перегружающее хостовую систему.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 8 3 3 2
Разбор двухчасового инцидента на продуктивном Kubernetes-кластере, причиной которого стала неочевидная каскадная цепочка из настроек Nginx, cgroups systemd и специфики работы ядра Linux при динамическом изменении RAM виртуалки.
Если коротко, симптомы и цепочка отказа:
503 Service Unavailable, в логах внешнего proxy (Envoy Gateway) — UF и upstream_reset_before_response_started. В error.log самого ingress-nginx при этом была тишина, но Readiness-проба падала (:10246 connection refused), выбивая под из ротации.pids.max): в логах ноды (journalctl) обнаружилась ошибка cgroup: fork rejected by pids controller. Контейнер упёрся в лимит pids.max = 975 и не мог создать новые воркеры.worker-shutdown-timeout (240s). Частые reload'ы конфига привели к сосуществованию ~30 воркеров (3 поколения). Включенный aio thread pool (threads=32) давал по 33 задачи на воркер. Итого: ~990 задач, что превысило лимит 975.threads-max): лимит pids.max выставлялся через systemd DefaultTasksMax (15% от kernel.threads-max). Лимит threads-max составлял всего 6501 (в десятки раз ниже нормы), потому что KVM-виртуалка стартовала с минимальной RAM, а затем была расширена до 16 ГБ через ballooning/hotplug. Ядро считало threads-max один раз при загрузке OS и не пересчитало его при увеличении памяти.При использовании динамического расширения памяти (RAM hotplug/ballooning) на нодах Kubernetes ядро Linux не пересчитывает kernel.threads-max на лету. Это оставляет контейнеры с заниженными лимитами pids.max, что при штатных перезагрузках Nginx и наличии WebSocket/thread-пулов неизбежно приводит к fork rejected и падению ingress-контроллера.
Лимиты нужно проверять и корректировать на нодах вручную.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4 2 2
Основы_DevOps_и_Software_Delivery_Евгений_Брикман_2026.pdf
12.4 MB
В большинстве книг о DevOps лишь поверхностно рассматриваются теория и культура. В этом практическом руководстве описываются инструменты, практики и технологии, которые составляют основу software delivery — доставки программного обеспечения.
Автор показывает, как запускать и поддерживать программное обеспечение в продакшене шаг за шагом, на множестве примеров, которые дадут вам возможность поработать с реальными системами и реальным кодом.
Изучите основные концепции и лучшие практики современного DevOps и получите личный опыт и ценные навыки для работы DevOps, SRE и фулстек-разработчика.
Внутри:
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 10 6 3 3
Рассказываем о самой «вкусной части» грядущего митапа — воркшоп проведет Тимур Тукаев, COO Aenix (создатели Cozystack) — вместе вы разберете реальные сценарии миграции и риски, а не теорию со слайдов.
Что воркшоп даст вам:
Будет полезно инженерам уровня Middle+ и тимлидам: DevOps, SRE, системным архитекторам и всем, кто прямо сейчас строит private cloud в Казахстане.
После воркшопа будет основная программа Cloud Native Community Day Almaty — пять докладов от инженеров, которые ежедневно строят и масштабируют инфраструктуру в крупных компаниях.
Большая благодарность Astana Hub за предоставленную площадку и помощь в организации ивента!
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4 3 3 2
Разработка интеграций с внешней инфраструктурой (платежки, ID-провайдеры, SMS-шлюзы) всегда упирается в Sandboxes. И слепая вера в песочницу вендора ведет к инцидентам в продакшене и как выстроить надежный процесс тестирования.
- Тестовые среды вендоров — это симуляции, но не дубликаты продакшена. Вендоры обновляют песочницы по остаточному принципу.
- В продакшене появляется новое поле или меняется структура токена, а в песочнице — часто нет (или не сразу). Логика rate limiting и специфические HTTP 4xx/5xx ошибки в песочнице часто вовсе не имплементированы.
- Как итог успешный деплой и сбой на реальном трафике из-за расхождения среды с продакшеном, возникшего еще пару месяцев назад.
- Обработку nullable-полей, опциональных ключей и специфических типов.
- Проверку поведения системы при отваливающемся провайдере (таймауты, специфические коды ответов вроде 402, асинхронные вебхуки невпопад). Песочницы провайдеров чаще всего поддерживают только happy path.
- State Management: побочные эффекты тестирования (записи, аудит-логи) остаются в песочнице провайдера. Внезапные плавающие сбои в CI часто вызваны грязным состоянием тестовой среды вендора.
Чтобы не зависеть от изменения чужих сред, инженерные команды переходят на локально контролируемый baseline:
- Запись и воспроизведение трафика: перехват реальных HTTP-ответов (через Keploy, Hoverfly, WireMock в режиме записи) и сохранение их в качестве локальных фикстур.
- Версионирование фикстур в Git: обновление фикстур становится осознанным коммитом в репозиторий, а не фоновым изменением на стороне вендора.
- Explicit Fault Injection: явное создание фикстур под таймауты, битые JSON и специфические 5xx-ошибки.
Contract testing проверяет схему (структуру запроса и ответа). Но он не ловит поведенческие изменения под капотом. Схема может оставаться валидной, но провайдер изменил формулу расчета комиссии или сделал синхронный вебхук асинхронным. Схема совпала, логика сломалась.
Главный подводный камень собственного Record & Replay — протухание фикстур. В качестве решения процесс обновления фикстур должен быть явно закреплен за командой (explicit ownership) и входить в техдолг/бэклог при каждом релизе изменений в API провайдера.
Песочница провайдера подходит для первичного exploratory-тестирования и smoke-тестов. Регрессионный пайплайн должен опираться на локально зафиксированные, версионируемые фикстуры реальных ответов.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 2 2 2
Разыгрываем 10 ваучеров со скидкой 50% на абсолютно весь каталог от The Linux Foundation и 10 комплект видеокурсов по Kubernetes со скидкой 50% от Slurm.
⚪️ Каталог курсов и сертификации
Ваучеры можно применить к любому:
— онлайн-курсу
— сертификационному экзамену (CKA, CKS, CKAD и другие)
— пакету продуктов (курс + сертификация)
— курс под руководством инструктора с гарантированным стартом
⚪️ Запись на поток Kubernetes: Продвинутый уровень от Slurm.
Условия розыгрыша:
✅ Подпишитесь на KazDevOps и нажмите кнопку "Учавствую!" под оригинальным постом в канале KazDevOps.
❗️ 1 сентября подведем итоги и выберем 10 победителей (каждый получит скидку на предложения Linux Foundation + скидку на курс Slurm). Активировать ваучеры Linux Foundation нужно до 07.01.2027. После этого у вас будет 1 год и 2 попытки, чтобы завершить обучение и сдать экзамен.
Go-go-go, и успехов!
@DevOpsKaz😛
Ваучеры можно применить к любому:
— онлайн-курсу
— сертификационному экзамену (CKA, CKS, CKAD и другие)
— пакету продуктов (курс + сертификация)
— курс под руководством инструктора с гарантированным стартом
Условия розыгрыша:
Go-go-go, и успехов!
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
2 10 4 3 2 2 2
Встречаемся 13 августа в Almaty Hub, чтобы провести целый день в Сloud Native: от практической миграции виртуальных машин до технических докладов, живых обсуждений и after-party. Публикуем программу с таймингом.
10:00 — практический воркшопВместе с Тимуром Тукаевым, COO Aenix и одним из создателей Cozystack, разберём переход от классической виртуализации к cloud native private cloud: перенесём виртуальную машину в KubeVirt и посмотрим, как работают Kubernetes, LINSTOR, Cilium и другие open-source компоненты.
13:00 — обедПосле обеда 5 технических докладов — реальные кейсы и инженерные решения:
14:00 — «Как скрыть control plane k8s и что это дает»14:40 — «Защита Kubernetes-кластера с помощью Kubescape»15:20 — «За пределами одного кластера: Istio Multi-Cluster между AWS-аккаунтами»16:00 — «Longhorn: когда Ceph слишком тяжёл, а local storage уже не хватает»16:40 — «Kubernetes как Linux Kernel: какое будущее ждет самый популярный оркестратор»А после — after-party и общение с теми, кто каждый день строит, ломает, масштабирует и чинит инфраструктуру.
Ждем всех в Almaty Hub 13 августа в 10:00. Мероприятие проходит при поддержке команды Astana Hub — благодаря их экосистеме митапы возможны!
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 7 3 3 2
Мы в Core 24/7 часто рассказываем о модернизации инфраструктуры, миграции и аудите, но основная наша деятельность — это DevOps-поддержка. Мы заходим в проект, соблюдая все юридические тонкости, и берем его на поддержку + развитие. Целая команда из инженеров разного уровня трудится, чтобы у сервисов, которыми пользуются миллионы казахстанцев, все работало как часы.
В новом кейсе рассказали, что конкретно сделали и делаем для образовательной платформы Juz40 — и это лишь малая часть.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 7 2 2