Традиционный митап под эгидой CNCF состоится уже 13 августа. Это бесплатный митап, где знакомятся, находят помощь в сложных задачах, договариваются о коллаборациях и проектах.
В одном зале соберутся SRE, DevOps, платформенные инженеры, архитекторы. На этот раз людей будет больше — по вашим просьбам увеличили кол-во участников до 100-150 человек, но места быстро заканчиваются.
Мероприятия пройдет в Almaty Hub.
Что вас ждет:
Скоро начнем объявлять спикеров и знакомить вас с конкретными докладами.
Если слышите о мероприятии впервые, посмотрите, как это было раньше.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
2 6 3 2 2 1
После того как Cloudflare изменила внутреннюю архитектуру сервиса Cloudflare Images (переведя его с сетевых сокетов на локальные Unix-сокеты для ускорения работы), клиенты начали жаловаться, получая битые или недозагруженные картинки.
Обычные инструменты логирования на уровне приложения ничего не показывали — для них все выглядело идеально. Попытки воспроизвести баг локально через
curl тоже провалились. Команда инженеров искала баг 6 недель, а исправила всего четырьмя строчками кода. Прорыв случился, когда инженеры подключили низкоуровневую утилиту ядра
strace, чтобы отследить системные вызовы к сокетам. Оказалось, что при отправке больших файлов процесс делал один системный вызов записи в буфер сокета (sendto), а следующим шагом сразу же закрывал соединение на запись (shutdown), хотя большая часть данных еще оставалась во внутреннем буфере библиотеки.Виновником оказалась hyper — популярная open-source библиотека на Rust для работы с HTTP. Баг сидел в ней годами во множестве версий.
В цикле обработки соединений (
dispatch.rs) библиотека вызывала функцию сброса данных из буфера в сокет (poll_flush). Однако результат этого вызова просто игнорировался с помощью конструкции let _ = self.poll_flush(cx)?;. Если сокет на стороне получателя на пару миллисекунд заполнялся, функция возвращала статус «ожидания» (Poll::Pending), сообщая, что данные еще не ушли. Но из-за let _ библиотека игнорировала это, считала, что всё успешно отправлено, и преждевременно вызывала закрытие сокета, обрубая хвост файла.Когда вы проектируете межсервисное взаимодействие на сверхвысоких скоростях (особенно в K8s через sidecar-контейнеры, mesh-сети или локальные сокеты), всегда закладывайте тесты на переполнение буферов и симулируйте медленных клиентов.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 3 3 2 1
Поскольку
etcd является критически важным «сердцем» Kubernetes (хранилищем состояния кластера), это обновление напрямую влияет на производительность и стабильность будущих версий. Разбираем самое важное из релиза.Раньше, если клиент запрашивал огромный объем данных, etcd полностью собирал весь результат в буфер памяти, а затем отправлял его целиком. Это вызывало непредсказуемые скачки памяти и задержки как на сервере, так и на клиенте.
Что изменилось: добавлен метод RangeStream RPC. Теперь большие выборки данных отправляются клиенту частями (чанками/стримом). Это сделает работу тяжелых контроллеров в больших кластерах гораздо более стабильной.
Команда заявляет о заметном снижении потребления CPU процессами etcd по сравнению с версией 3.6.
При запросах ключей без их значений (например,
etcdctl get --keys-only), etcd теперь читает данные только из своей инкрементальной памяти. Больше нет нужды читать и десериализовать тяжелые значения из дискового хранилища bbolt (за исключением случаев сортировки по значению). Работа с механизмами аренды ключей стала быстрее и надежнее.etcd теперь загружается полностью из v3store. Из кодовой базы убрали последние остатки старого движка хранения V2 API, что сильно очистило архитектуру.Завершен масштабный оверхол библиотек Protobuf, устаревшие зависимости заменены на современные и полностью поддерживаемые.
- Поддержка Unix-сокетов
- Управление AuthStatus. Теперь можно запрашивать статус аутентификации кластера без предварительной авторизации
- Новые метрики для Watch
etcd v3.7 принесет долгожданное облегчение для master-нод. Кластеры с огромным количеством объектов станут потреблять меньше процессора, а API-сервер будет тратить меньше памяти.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 7 4 3
Начинаем анонсировать первых спикеров — и показываем, какие доклады уже есть. Перед вами все еще открыта возможность выступить на 100-150 человек, чтобы укрепить личный бренд, завести полезные знакомства и завоевать очки для своей карьеры.
Традиционно пользователи Kubernetes напрямую взаимодействуют с control plane, что усложняет эксплуатацию кластеров. Скрытие раскрывает возможности Kubernetes as a Service, передав управление инфраструктурой платформенной команде.
Managed-платформа должна автоматически создавать, масштабировать, обновлять и сопровождать кластеры на протяжении всего жизненного цикла. Для реализации такого подхода наиболее подходит Cluster API — благодаря декларативной модели управления и поддержке различных инфраструктур.
Обзор возможностей DevSecOps-инструмента Kubescape (CNCF) и опыт внедрения в релизные циклы.
Узнаете про статический и динамический режимы работы, генерацию отчетов безопасности, интеграцию с ArgoCD, настройку Alertmanager и мониторинг безопасности через Prometheus exporter.
Ждем вашей заявки на доклад о реальном опыте. Требования к докладу очень простые.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
2 8 4 4
Слёрм запускает бесплатную серию онлайн-занятий «ИИ для инженеров: польза и риски», где разбирают реальные сценарии:
— как ИИ помогает DevOps-, SRE- и infrastructure-командам
— как использовать LLM для алёртов, инцидентов, логов, тикетов и документации
— где ИИ реально экономит время, а где создаёт новые риски
— как проверять результат модели и не ловить галлюцинации в проде
— что делать с безопасностью, данными, compliance и юридическими ограничениями
— как встроить ИИ в рабочий процесс, а не просто иногда спрашивать у него команды.
За 30 минут вы защитите Linux-сервер по пошаговой инструкции: создадите безопасного пользователя, настроите SSH, UFW, fail2ban, автообновления, проверите открытые порты и cron, а также получите рекомендации для дальнейшей безопасной эксплуатации.
Не тратьте время на поиск нужных модулей Ansible — держите под рукой шпаргалку с 30 самыми востребованными модулями и готовыми примерами.
В новой статье разобрали 5 ключевых проблем — от недетерминированности и контекста до тестирования и мониторинга — с примерами кода и практическим роадмапом внедрения
Понимание архитектуры Kafka — это must-have для IT-специалистов, которые хотят избежать множества ошибок в работе с данными. Курс поможет быстро разобраться с ключевыми понятиями и терминами мира Kafka. Внутри: видеоурок + презентация, глоссарий в PDF-формате с основными терминами, тестирование для проверки себя.
Научитесь строить отказоустойчивый кластер без тонны документации. Разберётесь, как Kafka работает изнутри, чтобы предотвращать инциденты и держать систему стабильной под нагрузкой
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 3 2 2 2
Приложения в нескольких кластерах развёртывают по нескольким причинам:
Namespaces, разделение по кластерам защищает от сбоев на уровне Control-Plane.Самый очевидный способ связать два сервиса в разных кластерах — выставить сервис в кластере-2 наружу через
LoadBalancer и стучаться в него из кластера-1 по внешнему IP. Но есть и минусы:Cluster Mesh работает иначе: создает единую виртуальную оверлейную сеть между кластерами. Для приложений это выглядит так, будто они находятся в одной сети с единым пространством имен и идентичностей.
Чтобы узнать, как объединить Kubernetes-кластеры в разных облаках через Cluster Mesh на примере Cilium, Amazon EKS (AWS) и Google GKE (GCP), рекомендуем статью. Узнаете про архитектуру сетевого взаимодействия, режимы маршрутизации CNI, посмотрите практический сценарий и сможете реализовать у себя.👈 Читать статью
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 5 4 3 2
Фраза, которую на дежурствах произносят по абсолютно разным поводам. Но понимаем ли мы, что произошло на самом деле?
Путаница между банальным рестартом процесса в контейнере, полной заменой объекта пода или горячей перезагрузкой конфигов часто приводит к неверным решениям в 2 часа ночи.
В новой статье детально разбираем внутренние механизмы Kubernetes и то, как на самом деле принимаются решения о перезапуске.
Что внутри:
pod spec и игнорирует изменения ConfigMap/Secrets в переменных окружения. inotify часто пропускает обновления конфигурации. Разбираем теорию на практических схемах и командах для отладки.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 5 3 2
На онлайн-лекции 16 июля разберут, как построить надежную и предсказуемую сеть Kubernetes в on-prem кластере.
Спикер — Сергей Сперанский, Senior Infrastructure Platform Engineer.
Узнаете:
Когда: 16 июля, 19:00
Формат: онлайн
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
3 4 4 2 2
IDP версии 1.0 снижали когнитивную нагрузку на людей, но не проектировались под агентов, которым нужны GPU/TPU, управление жизненным циклом моделей, валидация контекста через MCP и контроль доступа к данным.
Если платформа не даёт агентам управляемого доступа к ресурсам, они либо упираются в квоты, либо разъезжаются по shadow-инфраструктуре.
В блоге CNCF описали переход от Golden Paths к адаптивным платформам, где AI-агенты становятся first-class citizens наравне с разработчиками.
CNCF выделяет пять сдвигов:
Ключевая мысль в том, что выдержат нагрузку без структурного долга те платформы, которые изначально строились композируемыми.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 3 2 2
Сегодня в программе: критическое состояние экосистемы MCP-серверов, влияние контейнеризации на ИБ и автоматический мониторинг инфраструктуры на государственном уровне. Только самое важное из мира безопасности.
Команда Canopii просканировала более 11 000 публично доступных MCP-серверов. Результаты оказались крайне тревожными. Серверы с 1000+ звёзд в 5 раз чаще оказываются в зоне высокого риска (категории D или F).
- 232 сервера содержат подтверждённые опасные «синки» (eval, shell-инъекции, десериализация непроверенных данных).
- 78% серверов не используют dependency pinning (фиксацию версий зависимостей), что делает их уязвимыми к скрытым обновлениям.
- 1617 серверов прямо сейчас поставляются с известными опубликованными уязвимостями (в топе устаревших пакетов — библиотеки JWT и криптографии).
- 260 серверов запускают install-скрипты прямо на рабочем месте пользователя ещё до старта самого сервера.
- в 31% случаев (24 из 77 серверов, декларирующих авторизацию) эндпоинты отдавали полный список инструментов анонимным пользователям без проверки учётных данных.
Специфика безопасности контейнеров тесно связана с эволюцией контейнерных технологий. Ландшафт ИБ меняется, и перед инженерами встают новые вызовы. Несет ли Kubernetes оверхед, насколько он безопасен по умолчанию и нужно ли для безопасности контейнеров отдельное направление в ИБ? На эти и другие вопросы смотрите ответы в записи.
Спикеры:
– Александр Лысенко, ведущий эксперт по безопасности разработки и ИИ К2 Кибербезопасность;
– Дмитрий Евдокимов, основатель и технический директор Luntry.
Интереснейший доклад от инженера, как устроен государственный мониторинг безопасности «снаружи». Спикер рассказывает, как они автоматически сканируют всю доступную им инфраструктуру (а иногда и ту, куда их особо не приглашали, ради общего блага).
Команда всего из 6 инженеров держит всю систему на понятных и привычных Kubernetes и PostgreSQL. При этом уязвимости они детектируют вагонами, подтверждая эффективность простого и прагматичного подхода.
Берегите свои серверы, пиньте зависимости в MCP и отличных безопасных выходных
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 3 3 2
Как создавать ИИ-агентов, которым можно доверять
Онлайн-интенсив AI Agents Security Week от Школы анализа данных Yandex (ШАД) раскроет эту тему с 27 по 31 июля. Эксперты Yandex поделятся, с какими угрозами сталкиваются ИИ-агенты и как защитить свои проекты уже на этапе проектирования.
В программе:
— Чем ИИ-агенты отличаются от больших языковых моделей
— Как защищать системы от взломов, утечек данных, ошибок конфигурации и других угроз
— Какие ошибки встречались в ИИ-системах DeepSeek, Microsoft Bing и Amazon
Регистрируйтесь на 5 дней видеотрансляций с возможностью задать вопросы
[Зарегистрироваться]
Онлайн-интенсив AI Agents Security Week от Школы анализа данных Yandex (ШАД) раскроет эту тему с 27 по 31 июля. Эксперты Yandex поделятся, с какими угрозами сталкиваются ИИ-агенты и как защитить свои проекты уже на этапе проектирования.
В программе:
— Чем ИИ-агенты отличаются от больших языковых моделей
— Как защищать системы от взломов, утечек данных, ошибок конфигурации и других угроз
— Какие ошибки встречались в ИИ-системах DeepSeek, Microsoft Bing и Amazon
Интенсив подойдет тем, кто активно вайбкодит и хочет получать безопасные продукты на выходе. Для старта достаточно знать, как писать промпты и запускать получившийся код.
Регистрируйтесь на 5 дней видеотрансляций с возможностью задать вопросы
[Зарегистрироваться]
1 6 3 2 2
Перед вами все еще открыта возможность выступить на 100-150 человек, чтобы укрепить личный бренд, завести полезные знакомства и завоевать очки для своей карьеры.
Как построить Istio Multi-Cluster между несколькими AWS-аккаунтами, связать распределённые сервисы и какие архитектурные решения помогают масштабировать облачную платформу.
Когда Longhorn становится оптимальным выбором для Kubernetes, какие задачи он решает и какие компромиссы стоит учитывать при эксплуатации.
Если у вас есть история, которой не хватает в этой программе, расскажите её.
Не идеальный проект. Не идеальная архитектура.
Возможно, именно ваш production-кейс поможет кому-то избежать бессонной ночи.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4 2 2
Расскажут, как развивается цифровая экосистема Halyk: как команды работают с данными, принимают продуктовые решения и создают сервисы, которыми ежедневно пользуются миллионы пользователей.
Алматы, ТРЦ Forum, зал Event Space
22 июля | 🕖 19:00
Участие бесплатное после регистрации.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4 3 2
Похоже, Atlassian решила кардинально изменить правила игры. Пока создатели IDE и AI-ассистентов спорят, где должен жить искусственный интеллект, Jira делает сильный ход. Компания превращает привычный таск-трекер в полноценную платформу для управления, оркестрации и аудита AI-агентов.
Что меняется в инженерных воркфлоу:
В Jira теперь можно напрямую подключать Claude Code, Cursor и GitHub Copilot (поддержка OpenAI Codex на подходе). Задачи можно делегировать AI-инструментам прямо из интерфейса трекера
В платные тарифы внедряют агента-разработчика. Он берет контекст из тикета и генерирует готовый к ревью Pull Request. Разработчику вообще не нужно разворачивать и настраивать под эту задачу локальное окружение — агент всё сделает сам.
Инструмент умеет сканировать кодовую базу, историю тикетов в Jira и документацию в Confluence, чтобы автоматически собирать структурированные технические спецификации. По ним потом могут работать как люди, так и сторонние AI-инструменты.
Больше никаких внезапных счетов за токены от команды. Появился дашборд для контроля затрат на сторонние AI-сервисы (Claude, Cursor, Copilot) в разрезе конкретных проектов Jira.
Обновленный Loom теперь умеет записывать экран, ваши клики и голос, а затем превращать это в структурированный action-plan, который понятен AI-агентам, или сразу конвертировать запись в готовые таски Jira.
💡 Atlassian делает ставку на то, что координация и комплаенс AI-разработки должны происходить там, где проект реально живет (не внутри редакторов кода). Для команд уже завезли шаблон проекта Agentic Engineering и визард для быстрой настройки.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 3 2 2 1
В канале он рассказывает:
Please open Telegram to view this post
VIEW IN TELEGRAM
1 2 2 2 2
Рекомендуем качественный контент знакомого ИТ-сообщества с 15-летним стажем:
Please open Telegram to view this post
VIEW IN TELEGRAM