На предстоящем митапе Superapps & MiniApps Meetup с докладом «FinOps на пальцах» выступит Мирас Байгашев, DevOps Team Lead в компании Core 24/7. Вы можете узнать об этой теме еще до DevOpsDays — уже 24 сентября.
Когда superapp или экосистема сервисов начинает активно расти, расходы на облачный биллинг и серверные мощности часто становятся неуправляемыми. FinOps — это подход, который помогает выстроить прозрачный контроль над затратами без потери производительности и надежности.
В своем выступлении Мирас разберет:
На митапе вы также узнаете:
Как развиваются SuperApps и какую роль в них играют MiniApps? Эксперты Halyk Bank и приглашённые спикеры расскажут, как сегодня развиваются цифровые экосистемы и какую роль в них играют мини-приложения.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 5 2 2
Kubernetes-контроллер, который отслеживает сбои в кластере, автоматически их расследует и открывает pull-реквесты с исправлениями в вашем GitOps-репозитории. Если Pod уходит в
CrashLoopBackOff, Deployment деградирует или узел переходит в статус NotReady, контроллер запускает внутрикластерного агента OpenCode. Он инспектирует текущее состояние, находит соответствующие манифесты в репозитории, определяет первопричину и предлагает готовый фикс через PR.Оптимизатор затрат на инфраструктуру Kubernetes. Подключается к работающему кластеру (или сохраненному снапшоту), собирает все ограничения планировщика (
scheduling constraints) и использует constraint programming (CP-SAT) для поиска наиболее дешевого парка узлов, который гарантированно удовлетворяет всем правилам размещения.Локальный маршрутизатор инференса (PAIR) от NVIDIA для группы совместимых компьютеров в одной сети. Он обнаруживает доступные узлы, управляет движками инференса и предоставляет приложениям и агентам прокси-эндпоинты, совместимые с API Ollama и OpenAI. Входящие запросы маршрутизируются на подходящие узлы с учетом наличия нужной модели, поддерживаемого движка и текущей вычислительной нагрузки.
Навык для AI-агентов, предназначенный для создания точных и проверяемых диаграмм: архитектуры, workflow, sequence, потоков данных и жизненных циклов. Результат генерируется в виде автономного HTML-документа с поддержкой анимации и качественным экспортом статики.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 3 3 3 2
Главная идея cамой масштабной хакерской конференции в Центральной Азии — перейти от простой защиты к киберустойчивости: способности государства, бизнеса и общества выдерживать цифровые атаки, быстро восстанавливаться и продолжать работу.
Первый день будет посвящен киберустойчивости государства, бизнеса, критической инфраструктуры и безопасности граждан.
Второй день объединит безопасную разработку, техническую кибербезопасность и практический хакинг.
Организатор конференции — TSARKA, региональный лидер в области кибербезопасности и цифрового суверенитета, совместно с МИИЦР РК, Департаментом противодействию киберпреступности МВД РК и Акиматом города Астаны.
29–30 сентября 2026 года
г. Астана, Дворец Независимости
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4 2 2 2
Ключевой процесс — сохранить старые DNS как точки совместимости. В старом namespace временно оставляем
Service типа ExternalName, который перенаправляет запросы на сервис в новом namespace.Такой сценарий используется во время миграции:
Внутренний и внешний трафик нужно рассматривать отдельно: перенос
Service сам по себе не решает проблему Ingress.@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 5 2 2
Forwarded from DevOpsDays Almaty 2026
Тамерлан развивает распределённые системы, cloud-native инфраструктуру и observability в BCC-HUB. В его фокусе в том числе — платформа распределённой трассировки на базе OpenTelemetry для инфраструктуры с 1000+ микросервисов.
На конференции Тамерлан выступит с докладом «Распределённая трассировка: как получить целостную картину системы».
Когда в инфраструктуре больше тысячи микросервисов, сложно понять работу системы по отдельным трассировкам. Поэтому данные трассировки можно использовать не только для анализа отдельных запросов, но и для получения общей картины взаимодействия сервисов.
В докладе Тамерлан покажет:
🎟 Покупайте билет на себя или компанию — мощная программа, полезный нетворкинг и буст ваших навыков гарантированы.
@devopsdayskz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 5 4 2
Летом 4SELL переехала в Yandex Cloud — всего за 3 недели и своими силами.
Сооснователь стартапа Роман Белопольский и архитектор Yandex Cloud Иван Кабанов рассказывают, какие потребности были у платформы и как выглядит финальная облачная архитектура, которая сейчас отвечает за обработку 100% транзакций.
Кратко: инфраструктура платформы построена на управляемых сервисах Yandex Cloud. Yandex Managed Service for Kubernetes® и Yandex Compute Cloud используются для запуска бэкенд-сервисов, API-серверов и компонентов обработки аудиопотоков. POS-транзакции, данные сотрудников, бонусы и метрики хранятся в Yandex Managed Service for PostgreSQL, а диалоги и результаты аналитики — в Yandex Object Storage. Аудиофайлы используют только для транскрибации и не хранят после обработки.
Сейчас валовая рентабельность платформы составляет 60%, а LTV/CAC превышает 3,95 и продолжает расти.
Please open Telegram to view this post
VIEW IN TELEGRAM
1 5 3 3
Сохраняйте и делитесь с коллегами подборкой ресурсов, кейсов и инструментов для тех, кто хочет глубже разобраться в практике управления затратами на инфраструктуру.
База и стандарты FinOps
Доклады и реальные кейсы компаний
Инструменты и решения
terraform apply Токеномика
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 3 2 2 2
В авиации есть термин Type Conversion — процесс, когда опытный пилот пересаживается на новый тип самолёта. Он не учится летать заново: физика полёта та же, но кабина и тумблеры другие.
Билл Данкан (SRE-инженер и пилот) отлично перенёс эту концепцию на онбординг в новую DevOps/SRE-команду. Вот 4 правила, которые помогут не упасть в первый месяц:
Аэродинамика одинакова для Cessna и Boeing. Бюджеты ошибок, контроль blast radius и дисциплина быстрых откатов не зависят от компании — вы приносите эти знания с собой в первый день.
Скорость и высота отображаются везде. В прод-системах это Latency, Error Rate, Saturation (методы RED/USE). На новом месте меняется только табло: Datadog, Grafana или забытый дашборд. Задача первой недели — понять, где смотрят метрики и какие из них «врут» под нагрузкой.
Вы умеете катить релизы. Но если прошлый опыт — это GitOps + ArgoCD, а в новой компании — ручной деплой через Jenkins, автопилот сыграет против вас. Ошибки в первый месяц происходят не от недостатка квалификации, а от применения старых привычек к новым рычагам.
В авиации есть V-speeds — специфичные для каждого борта критические скорости. Попытка зайти на посадку на параметрах другого самолёта приведет к катастрофе. В SRE это пороги онколла, целевые SLO, определение SEV1 и цепочки эскалаций. Их нужно выучить назубок из ранбуков и постмортемов еще до первого ночного дежурства.
Не пытайтесь в первые недели лететь «соло». Изучите системы, поспрашивайте опытных пилотов (инженеров) и не делайте выводов о переключателях, пока лично не проверите, за что они отвечают.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4🗿2 2 2
Что в программе:
Практическая часть программы включает встречи с ML-специалистами Yandex и других технологических компаний страны. Студенты будут разбирать примеры реальных систем, их архитектуру и логику.
Обучение будет проходить очно на базе alem ai в Астане 2-3 раза в неделю.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
Наш общий страх оправдался: в сети все больше новостей, про то как суперсовременные ИИ-модели убивают многочасовой труд инженеров и разработчиков.
Важно помнить, что у агента (какой бы крутой он ни был) нет того контекста, который есть у инженера: он действует в рамках выданных прав и полученной инструкции, а не по интуитивному пониманию, какой ресурс трогать нельзя.
В новой статье разбираем, как ограничить ущерб от автономных ошибок.
@DevOpsKaz
Please open Telegram to view this post
VIEW IN TELEGRAM
🗿3 3 2 2 2
Forwarded from DevOpsDays Almaty 2026
Нэлия руководит платформенной командой, с которой разрабатывает внутренние инфраструктурные сервисы (Kubernetes, PostgreSQL, Kafka, MongoDB, Cassandra, RabbitMQ, Consul, etc.) и процедуры по их эксплуатации (установка, апгрейды, бэкапы, мониторинг, траблшутинг).
Полная автоматизация, обратная совместимость, L3–L4 поддержка и участие в разборе production-инцидентов. Нэлия хорошо знает, что действительно работает, а что нет. Ops-команда разворачивает эти решения на 100+ Kubernetes-кластерах и в десятках production-инсталляций Tier-1 телеком-операторов по всему миру.
На DevOpsDays Нэлия представит доклад From Runbooks to Troubleshooting Skills.
Она расскажет, почему доступ к знаниям ещё не делает агента полезным, чем skill отличается от стандартной документации и как управлять skills в масштабе десятков команд. И, главное, на какие грабли команда уже наступила и что из этого вынесла.
Это не история успеха. Это реальный путь внедрения AI в анализ инцидентов.
🎟 Покупайте билет на себя или компанию — мощная программа, полезный нетворкинг и буст ваших навыков гарантированы.
@devopsdayskz
Please open Telegram to view this post
VIEW IN TELEGRAM
1 5 5 2