DevOps/SRE_Jobs
3.28K subscribers
6 photos
3.6K links
Обсуждаем вакансии и все с ними связанное.

Оформить и предложить вакансию можно тут: @cyberJohnny
Реклама - @cyberJohnny
Download Telegram
Публикатор: Надежда
Обсуждение:
#вакансия #рф #удаленка

Должность: DevOps Middle
Формат работы: удаленка
Компания: PlaysDev - международная IT-компания
ЗП: от 150 тыс. руб. до 170 тыс. руб.
Локация: РФ
Оформление: ТК РФ

Требования:
- Опыт работы DevOps/SRE от 1-го года
- Уверенное знание Linux
- Опыт работы с контейнерами и оркестрацией: Docker, Kubernetes
- Опыт построения CI/CD: GitLab CI / Jenkins / GitHub Actions
- Опыт работы с Terraform и Ansible (будет плюсом)
- Опыт работы с облаками: Amazon Web Services / Google Cloud Platform / Microsoft Azure (будет плюсом)
Уверенное владение Prometheus, Grafana, ELK Stack / Loki
- Опыт работы с Git

Основные задачи:
- Разработка и поддержка CI/CD пайплайнов
- Автоматизация инфраструктуры (IaC)
- Развертывание и поддержка Kubernetes-кластеров
- Обеспечение отказоустойчивости и масштабируемости систем
- Оптимизация cloud-инфраструктуры и затрат
- Поддержка production-среды

подробности в тг - @nadya_PlaysDev

@DevOpsSRE_Jobs
💩1
Публикатор: Nelly
Обсуждение:
#вакансия #MLOps #DevOps #Python #LLM #AI #MachineLearning
#Kubernetes #Docker #CI_CD #PostgreSQL

Мы создаем экосистему цифровых сотрудников на базе передовых открытых LLM/VLM-моделей. Наши ИИ-агенты автоматизируют ключевые операционные процессы, напрямую влияя на эффективность и конкурентное преимущество бизнеса наших заказчиков.

Компания: Selecty
Позиция: MLOps (банк)
Уровень дохода: 250-340 к гросс
Формат: оформление по ТК РФ
Удаленка РФ


чем предстоит заниматься:

Ты станешь ключевым инженером, который превращает исследовательские прототипы в отказоустойчивую GenOps-фабрику цифровых агентов.

Твои задачи: DevOps для AI:
Проектирование и развитие самообслуживания CI/CD пайплайнов для внутреннего деплоя AI-агентов и мультиагентных систем.

Инференс под управление: Развертывание и оптимизация LLM/VLM в процессе разработки (оптимизация памяти, формирование скорости) с использованием vLLM, Triton Inference Server, SGLang.

Надёжность: Обеспечение высокой доступности сервисов, работа с масштабированием горизонтальных подов и управление состоянием агентов.

Мониторинг 360°: Внедрение комплексного наблюдения: от стандартных метрик (CPU/GPU, задержка) до конкретных ML-метрик (качество генерации, дрейф данных, оценка тональности ответов).

Обязательные требования

Опыт вывода LLM-решений в прод.
* Уверенное владение Python и асинхронным программированием (asyncio).
* Уверенное владение Kubernetes (Helm, управление кластерами).
* Знание Gitlab CI, Jenkins и пр
* Понимание архитектуры RAG-систем, работы embedding-моделей и ранжирования.
* Умение оптимизировать инференс: квантизация, continuous batching, PagedAttention.
* Будет плюсом: опыт с графовыми БД и построением мультиагентных систем

Технологический стек:
Python, FastAPI, langchain/llamaindex/haystack k8s, docker, S3, postgres
Опыт работы с векторными и графическими БД.


Условия

Оформление по ТК РФв в IT-аккредитованную компанию
ДМС (включая стоматологию)
Компенсация фитнеса
Скидки на обучение английскому (Skyeng)
Индексация заработной платы
Современная техника
IT-аккредитация компании

Место для откликов: @Nelly_Selecty

@DevOpsSRE_Jobs
Публикатор: Anatoliy Lavrenov
Обсуждение:
#москва #вакансия #fulltime #vacancy #сисадмин #Linux #Ceph

Системный администратор Linux

Локация: Москва
ЗП: 250 000 - 300 000 net
Занятость: Полная, Гибридный формат
Оформление: ТК РФ
Компания: Федеральное Медико-биологическое агентство

ЦСП ФМБА занимается научными исследованиями связанными с геномом человека и анализом полученных данных.
Группа разработки создает внутренние сервисы для автоматизации движения, обработки и распределенного хранения больших объемов данных.

Требования:

Опыт работы от 3-х лет в должности системного администратора в крупных компаниях с территориально-распределенной структурой;
Высокий уровень системного администрирование и траблшутинг серверных операционных систем Linux (Ubuntu,Centos)
Виртуализация VMWare, Proxmox, KVM.
Знания и практический опыт в области развертывания и обслуживания СУБД (Postgresql,mysql);
Опыт проектирования и развертывания Active Directory, понимание архитектуры и схемы;
Опыт проектирования и развертывания кластерных сетевых служб DNS,DHCP, Как windows так и Linux
Знания технологий RAID;
Опыт работы с сетевым оборудованием:DELL, MikroTik, Mellanox, HP; знание и понимание принципов работы сетей TCP/IP, маршрутизации, VLAN;
Опыт работы с серверными платформами: Dell, Supermicro, IBM
Опыт внедрения и администрирования терминальных ферм, знание правил и принципов;
Умение создавать клиентский и инфраструктурные сервисы с нуля.
Знание основных протоколов передачи данных;
Практические навыки написания скриптов (Bash,Python);
Практический опыт работы с Zabbix, написания триггеров.
Наличие сертификатов приветствуется.
Знание английского языка на уровне, достаточном для чтения профессиональной литературы;
Умение самостоятельно осваивать различные технические концепции;
Будет плюсом - уметь разворачивать Ceph (крупные инсталляции), настраивать производительность, иметь опыт в эксплуатации и обновлении.

Важно:
Законченное высшее образование
Гражданство РФ

Задачи:

Развертывание, настройка и поддержка инфраструктуры
Настройка и работа с виртуализацией
Взаимодействие с командой разработки по ключевым вопросам


Условия:

Оформление по ТК РФ.
Работа в команде профессионалов на стыке передовых ИТ и науки. Мы работаем с Big Data и ML, у нас собственный корпоративный ЦОД.
Возможность профессионального роста, обучение.
График работы 5/2, гибрид, плавающее начало рабочего дня


Резюме отправлять @lavrenovtolya

@DevOpsSRE_Jobs
Публикатор: Mikhail
Обсуждение:
#резюме #devops #sre #remote

Senior DevOps / SRE / Infrastructure Engineer — удалённо, B2B

17+ лет единственным инженером инфраструктуры непрерывного производства (24/7): виртуализация, сети, мониторинг, backup/DR, дежурства. 25+ лет Linux.

Стек: Kubernetes (bare-metal k3s, Helm, ArgoCD GitOps) · Terraform, Ansible · VMware vSphere, Proxmox · Jenkins, GitLab CI, GitHub Actions · Prometheus, Grafana, Loki, VictoriaMetrics · Kafka (Strimzi), PostgreSQL · WireGuard, VLESS+Reality, Traefik, Nginx · Velero, Proxmox Backup Server · Go, Python (FastAPI, SQLAlchemy, Alembic), Bash

Публичные репозитории с CI: Go-утилита мониторинга туннельных нод + Python-сервис хранения истории проб, bare-metal Kubernetes/GitOps-стенд с регулярными DR-учениями. Ссылки на код и CV — в личке.

Ожидания по зарплате: от $3500 net (USD/USDT)

Формат: full remote, B2B-контракт, полная занятость. Готов приступить сразу.

Контакт: @baremetal_ops

@DevOpsSRE_Jobs
Публикатор: Владiмир
Обсуждение:
#вакансия #networkengineering #cloud

Infrastructure & Network Engineer

Город и адрес офиса: Польша / Варшава
Формат работы: офис
Занятость: полная
Зарплатная вилка: от 3 000 $ до 5 000 $
Компания: Tango.me (https://tango.me)

Описание вакансии:

Tango.me ищет Infrastructure & Network Engineer для работы в команде с 450M+ пользователей на платформе live-стриминга.

- Управление корпоративной идентичностью в Okta и сетевой инфраструктурой (LAN/WiFi, маршрутизация, VPN).
- Настройка и администрирование FortiGate, GCP, Google Workspace и CI/CD с использованием GitLab.
- Автоматизация процессов через скрипты (Bash, Python) и API интеграции.
- Поддержка и обновление технической документации.

Ключевые требования:

- 4+ лет опыта в инфраструктуре / сетевой инженерии.
- Уверенные навыки работы с сетями: LAN/WiFi, маршрутизация, DHCP/DNS.
- Опыт работы с Okta и GCP, администрирование Google Workspace.
- Знание GitLab и IaC (Terraform).
- Умение автоматизировать процессы и хорошее понимание безопасности.

@jakson_vill
Or Apply by the link

@DevOpsSRE_Jobs
Публикатор: HR Наталия
Обсуждение:
#вакансия #гибрид
Middle/ Middle+/Senior_Инженер системный_Банк_Гибрид МСК

-ЗП ( руб, гросс ): 220 000 - 320 000 ( ИП РФ )
-Сроки проекта: 3 мес +
-Гражданство РФ и локация РФ, Москва (гибрид ул. свободы д.57 к.1 )

@hr_natalya_d

Проект для банка: система мониторинга платежной системы.

Ключевые компетенции
Linux
Zabbix
ELK
OpenSearch
Prometheus/Grafana


Требования
Необходим специалист, которого можно подключить на работы, связанные с проектированием подключения систем к zabbix/opensearch, проектированием дашбордов, метрик и проч. По сути, нужен DevOps в направлении мониторинга.

1. Опыт работы с Zabbix, Prometheus;
2. Опыт работы с системами сбора, анализа и визуализации данных Elasticsearch/OpenSearch;
3. Опыт с Grafana;
4. Опыт администрирования серверных ОС Linux (SLES, AstraLinux);
5. Опыт написания технической документации, описания техпроцессов (инструкции, архитектурные документы, описания подсистем).

@DevOpsSRE_Jobs
Публикатор: Anatoliy Lavrenov
Обсуждение:
#москва #вакансия #fulltime #vacancy #сисадмин #Linux #Ceph

Системный администратор Linux

Локация: Москва
ЗП: 250 000 - 300 000 net
Занятость: Полная, Гибридный формат
Оформление: ТК РФ
Компания: Федеральное Медико-биологическое агентство

ЦСП ФМБА занимается научными исследованиями связанными с геномом человека и анализом полученных данных.
Группа разработки создает внутренние сервисы для автоматизации движения, обработки и распределенного хранения больших объемов данных.

Требования:

Опыт работы от 3-х лет в должности системного администратора в крупных компаниях с территориально-распределенной структурой;
Высокий уровень системного администрирование и траблшутинг серверных операционных систем Linux (Ubuntu,Centos)
Виртуализация VMWare, Proxmox, KVM.
Знания и практический опыт в области развертывания и обслуживания СУБД (Postgresql,mysql);
Опыт проектирования и развертывания Active Directory, понимание архитектуры и схемы;
Опыт проектирования и развертывания кластерных сетевых служб DNS,DHCP, Как windows так и Linux
Знания технологий RAID;
Опыт работы с сетевым оборудованием:DELL, MikroTik, Mellanox, HP; знание и понимание принципов работы сетей TCP/IP, маршрутизации, VLAN;
Опыт работы с серверными платформами: Dell, Supermicro, IBM
Опыт внедрения и администрирования терминальных ферм, знание правил и принципов;
Умение создавать клиентский и инфраструктурные сервисы с нуля.
Знание основных протоколов передачи данных;
Практические навыки написания скриптов (Bash,Python);
Практический опыт работы с Zabbix, написания триггеров.
Наличие сертификатов приветствуется.
Знание английского языка на уровне, достаточном для чтения профессиональной литературы;
Умение самостоятельно осваивать различные технические концепции;
Будет плюсом - уметь разворачивать Ceph (крупные инсталляции), настраивать производительность, иметь опыт в эксплуатации и обновлении.

Важно:
Законченное высшее образование
Гражданство РФ

Задачи:

Развертывание, настройка и поддержка инфраструктуры
Настройка и работа с виртуализацией
Взаимодействие с командой разработки по ключевым вопросам


Условия:

Оформление по ТК РФ.
Работа в команде профессионалов на стыке передовых ИТ и науки. Мы работаем с Big Data и ML, у нас собственный корпоративный ЦОД.
Возможность профессионального роста, обучение.
График работы 5/2, гибрид, плавающее начало рабочего дня


Резюме отправлять @lavrenovtolya

@DevOpsSRE_Jobs
Публикатор: Leha Popovich
Обсуждение:
#вакансия #DevOps

DevOps-инженер

ЗП: 3500 USDT — 5000 USDT / мес.

Ищем специалиста, который возьмет на себя инфраструктуру: от настройки серверов до автоматизации поставки кода в продакшн.

Чем предстоит заниматься:
Поддержка и развитие инфраструктуры: настройка и мониторинг Linux-серверов.

Автоматизация деплоя: организация бесперебойного процесса доставки обновлений (CI/CD).

Контейнеризация: упаковывание сервисов в Docker и управление их запуском.

Работа с оркестрацией приложений и обеспечение отказоустойчивости.

Наши ожидания:

Linux: уверенное владение командной строкой, понимание работы сетей, прав доступа и системных служб.

Docker: глубокое понимание принципов работы контейнеров, оптимизация сборки.

Оркестрация: опыт работы с HashiCorp Nomad — огромный плюс (или хороший опыт с Docker Swarm / Kubernetes и желание перейти на Nomad).

CI/CD: опыт настройки пайплайнов сборки и деплоя.

Резюме отправлять @pirat_somalii

@DevOpsSRE_Jobs
Публикатор: Владiмир
Обсуждение:
#вакансия #networkengineering #GCP #cloud

Инженер по инфраструктуре и сетям

Город и адрес офиса: Кипр / Лимасол
Формат работы: офис
Занятость: полная
Зарплатная вилка: от 3 000 $ до 5 000 $
Компания: Tango.me (https://tango.me)

Описание вакансии:

Tango.me ищет Инженера по инфраструктуре и сетям для поддержки масштабируемой live-стриминг платформы с 450M+ пользователей.

- Управление корпоративной идентичностью в Okta и интеграция приложений;
- Проектирование и обслуживание корпоративной сети (LAN/WiFi, маршрутизация, DHCP/DNS, VPN);
- Настройка и управление межсетевыми экранами FortiGate;
- Администрирование GCP и Google Workspace;
- Автоматизация процессов с использованием GitLab и скриптов (Bash, Python).

Ключевые требования:

- 4+ года опыта в инфраструктурном/сетевом инжиниринге;
- Глубокие знания сетевых технологий и их настройки;
- Опыт работы с Okta, GCP, Google Workspace;
- Умение автоматизировать процессы с помощью скриптов;
- Уровень английского достаточный для коммуникации с международной командой.

@jakson_vill
Or Apply by the link

@DevOpsSRE_Jobs
Публикатор: Olesya Recruiter
Обсуждение:
#вакансия #DevOps

Позиция: Senior DevOps/SRE Engineer
Вилка: 5000-6000$, обсуждается
Занятость: полная
Локация: удаленка по всему миру
Оформление: ТК РФ, B2B
Компания: NDA

В приоритете кандидаты, уже находящиеся на Кипре, а также кандидаты из Москвы и Московской области.

Сфера: iGaming / Sports
Мы создаем B2B-платформу в сфере iGaming и спорта.
Сейчас мы ищем Senior DevOps/SRE Engineer, который поможет развивать, масштабировать и поддерживать надежную инфраструктуру продукта.
Стек:
AWS, Cloudflare, IAM, WAF, Security Groups, EKS, Anti-DDoS, SAST/DAST, nmap, ss, net-tools, SOPS, Kubernetes Network Policies, Security Context, Kyverno, Trivy Operator, Vault, Zero Trust.
Чем предстоит заниматься:
— Разрабатывать и поддерживать инфраструктуру в AWS и on-prem-среде на базе Proxmox.
— Управлять Kubernetes-кластерами: настраивать, масштабировать и обеспечивать их стабильную работу.
— Автоматизировать процессы CI/CD с помощью GitLab CI.
— Настраивать мониторинг, логирование и алертинг, включая PagerDuty.
— Поддерживать и оптимизировать YDB, PostgreSQL, Vault, Valkey и сопутствующие сервисы.
— Работать совместно с командами разработки на Golang и Node.js.
— Оптимизировать производительность инфраструктуры и расходы на облачные ресурсы.
— Повышать надежность, отказоустойчивость и безопасность инфраструктуры.
— Автоматизировать инфраструктурные процессы и устранять причины повторяющихся инцидентов.
Мы ждем, что у тебя есть:
— Уверенный опыт работы с AWS: EC2, S3, IAM, EKS.
— Опыт работы с Infrastructure as Code: Terraform, OpenTofu и/или Terragrunt.
— Уверенные знания Kubernetes: Helm/Nelm, Ingress, API Gateway, управление секретами.
— Опыт настройки масштабирования с использованием Karpenter, KEDA, HPA и VPA.
— Опыт работы с CI/CD-системами, предпочтительно GitLab CI.
— Знание систем мониторинга, логирования и трассировки: Prometheus, VictoriaMetrics, Grafana, OTLP, Jaeger.
— Навыки администрирования Linux.
— Понимание принципов надежности, мониторинга, алертинга и реагирования на инциденты.
Почему с нами классно:
— Работаем с современными облачными технологиями и DevOps-практиками.
— Предлагаем интересные задачи по автоматизации, масштабированию и повышению надежности инфраструктуры.
— Дружная инженерная команда и обмен опытом с экспертами.
— Возможность релокации на Кипр, предоставляется релокационный пакет.

Контакты для связи:
@Olesya_Re

@DevOpsSRE_Jobs
Грейд: Senior/Senior+/Lead
Часовой пояс: работа по часовому поясу Нью-Йорк, США
Срок выхода: ASAP

Основная задача - разобраться в причинах текущих сбоев, устранить единичные точки отказа и построить предсказуемую, наблюдаемую и отказоустойчивую инфраструктуру.
Нам нужен специалист, который сможет не только предложить техническое решение, но и реализовать его самостоятельно.

Задачи:
— Провести аудит текущей production-инфраструктуры и сетевой архитектуры.
— Проанализировать причины существующих сбоев и найти узкие места.
— Выявить и устранить единичные точки отказа.
— Разработать и реализовать план повышения доступности инфраструктуры.
— Администрировать и развивать инфраструктуру на базе Proxmox VE:
кластеры, quorum и Corosync;
Proxmox HA;
— Настраивать floating IP/VIP и автоматическое переключение между узлами.
— Регулярно тестировать сценарии failover и восстановления после сбоев.
Настраивать и сопровождать сетевую инфраструктуру, маршрутизацию, NAT и firewall.
— Развивать мониторинг, централизованное логирование и систему оповещений.
— Участвовать в устранении production-инцидентов, проводить RCA и предотвращать повторные сбои.
— Автоматизировать инфраструктурные и эксплуатационные задачи.
— Создавать и поддерживать техническую документацию, схемы инфраструктуры и runbooks.

Что для нас важно:
— Сильные знания Linux, Ubuntu.
— Практический опыт эксплуатации production-инфраструктуры.
— Уверенный опыт работы с Proxmox VE.
— Понимание принципов построения отказоустойчивых систем.
— Практический опыт настройки HAProxy.
— Опыт настройки OpenResty или Nginx.
— Опыт работы с Keepalived и протоколом VRRP.
— Глубокое понимание TCP/IP, DNS, routing, NAT и VLAN.
— Опыт настройки firewall и ACL, включая iptables или nftables.
— Умение диагностировать сетевые проблемы с помощью tcpdump, ss, traceroute и других инструментов.
— Практический опыт настройки мониторинга и alerting.
— Навыки расследования сложных production-инцидентов и проведения Root Cause Analysis.
— Опыт автоматизации с помощью Bash или Python.
— Способность самостоятельно принимать технические решения и отвечать за результат.
Будет преимуществом:
— Опыт работы с Prometheus, Grafana, VictoriaMetrics или Zabbix.
— Опыт централизованного логирования с ELK или Loki.
— Опыт работы с Docker, Docker Compose или Docker Swarm.
— Знание Ansible или Puppet.
— Опыт создания CI/CD-пайплайнов в GitLab CI или Jenkins.
— Опыт администрирования, оптимизации и масштабирования MySQL.
— Знание Lua и опыт расширенной конфигурации OpenResty.
— Опыт построения backup- и disaster recovery-процессов.
— Опыт работы с высоконагруженными или business-critical системами.

Что мы предлагаем:
— Интересные уникальные задачи
— Работа по времени США - Нью Йорк
— Комфортные условия труда
— Высокая и официальная заработная плата
— Высококлассная техника для работы
— Бонусы по результатам работы
— Профессиональный рост
— Карьерный рост
— Удаленная работа
— Заработная плата по итогам собеседования

Контакт для отклика: @tina_hr29
Публикатор: HR IREV
Обсуждение:
#вакансия #vacancy #DevOps #Lead #офис #Fulltime #on-site

Рассматриваем кандидатов, уже находящихся на Кипре

Role: DevOps Engineer (Team Lead)
Location: Cyprus, Limassol (hybrid)
Company: IREV
Salary: €6k-€8,5k

About the role:
Be a key player in transforming the AdTech landscape as IREV's DevOps Lead. Elevate our infrastructure, impact thousands, and thrive in a culture that champions growth, innovation, and a strong work ethic. Join us and shape the future!

As a DevOps Lead at IREV, you will play a crucial role in maintaining our production and developer environments while providing support and knowledge to other departments within the organization.

Key responsibilities:
• Lead the design and implementation of scalable, reliable, and secure
infrastructure solutions utilizing modern DevOps practices.
• Collaborate with the team on existing projects, finalizing current
functionality, and introducing new features to our CRM/ERP product.
• Maintain and optimize production and developer environments to ensure
stability, scalability, and efficiency.
• Implement and manage application orchestration using Kubernetes.
• Establish and maintain monitoring systems with Prometheus and Grafana,
along with managing log systems using VictoriaMetrics, VictoriaLogs.
• Troubleshoot and resolve production incidents, participating in on-call
rotations to ensure 24/7 availability and service reliability.
• Manage databases, including PostgreSQL, ClickHouse, MongoDB and Redis.
• Contribute to the enhancement of infrastructure workflows and provide
support for PHP applications.
• Lead and mentor team members, providing guidance, support, and
mentorship to junior developers to foster their growth and development.
• Set clear goals and expectations for team members, ensuring alignment with
organizational objectives and priorities.
• Foster a collaborative and inclusive team culture, encouraging knowledge
sharing and teamwork among team members.

Our ideal candidate will possess:
• Minimum of 5 years of commercial experience as a DevOps Engineer.
2+ years of managerial experience.
• English proficiency at a B2 level.
• Scripting: Advanced in Bash and Python.
• Containers: Extensive experience with Kubernetes and Docker.
• Support: Experience with PHP application support.
• Cloud: Knowledge of DigitalOcean.
• CI/CD: Experience with GitLab CI/CD pipelines.
• IaC: Proficient in Terraform.
• GitOps: Experienced with GitOps practices.
• Automation: Knowledge of Jenkins CI/CD and Helm.
• Configuration: Familiar with Hashicorp Vault and Ansible.
• Monitoring: Experience with Loki and Jaeger.
• Project Management: Proficient in Jira.
• Soft Skills: Strong in problem-solving, communication, and experienced in
Agile/Scrum methodologies.

Benefits:
• Unlock a once-in-a-lifetime chance to join a fully bootstrapped and ready to
take-off SAAS company and shape your career with us!
• Comfortable office in the heart of Limassol, Cyprus.
• Competitive compensation package that reflects your skills and
experience.
• A transparent grade system that allows you to track your progress and
grow within the company.
• Enjoy a generous vacation package of 21 working days per year, with paid
vacation available after just 3 months of continuous employment.
• Take advantage of 7 paid sick leaves annually, no doctor's note required.
• An inclusive and adaptable company culture.
• Team Buildings and Happy hours.

Contact: @irev_irina

@DevOpsSRE_Jobs
Публикатор: Daria Lioibimova
Обсуждение:
#вакансия
Город и адрес офиса:
Лиссабон, Португалия
Формат работы:
Гибрид (2 дня в неделю в офисе)
Занятость:
Полная
Зарплатная вилка:
€50,000–75,000 gross/year + бенефиты
Особенности найма:
Рассматриваем кандидатов с опытом от 5 лет.
Возможна релокация в Португалию (предоставляется релокационный пакет).
Работа в международной распределенной продуктовой команде.
Описание вакансии:
Ищем DevOps Engineer в AnyLogic — международную продуктовую IT-компанию с более чем 20-летней историей, разрабатывающую одну из ведущих мировых платформ для имитационного моделирования. Наш продукт помогает крупнейшим компаниям из сфер производства, логистики, здравоохранения, транспорта, ритейла и других отраслей принимать более эффективные бизнес-решения с помощью моделирования.
Вы станете частью международной продуктовой команды, которая развивает собственный продукт, используемый тысячами компаний и университетов по всему миру. Это возможность работать над долгосрочным продуктом, влиять на развитие инфраструктуры и применять современные DevOps-подходы в глобальной среде.
Наш стек:
AWS
Terragrunt
Kubernetes
GitLab CI
Sentry
Чем предстоит заниматься:
Развивать и поддерживать облачную инфраструктуру.
Автоматизировать процессы CI/CD.
Работать с Kubernetes-кластерами.
Повышать надежность, безопасность и масштабируемость инфраструктуры.
Взаимодействовать с командами разработки и участвовать в развитии внутренних платформ.
Название компании:
AnyLogic
https://www.anylogic.com/
Контакты:
liubimova@anylogic.com (mailto:liubimova@anylogic.com)

@DevOpsSRE_Jobs
Публикатор: Anastasia
Обсуждение:
#вакансия #Devops #SRE #Moscow #fulltime

Senior / Lead DevOps (Platform / SRE)

GGR Global — международная группа компаний (iGaming). Разрабатываем собственные технологические продукты для глобальных рынков. Строим решения с нуля и растем без бюрократии.

Локация: Москва
Формат: Удаленный
Занятость: Полная (5/2, с 09:00 до 18:00 или с 10:00 до 19:00)
Оформление: Договор с ИП / Самозанятость (в РФ) или прямой контракт (вне РФ).
Зарплатная вилка: от 3500 до 6500 долларов

Задачи:
Развитие и эксплуатация self-managed K8s (bare-metal) платформы без коробочных managed-решений
Администрирование HA-кластеров PostgreSQL (Patroni), репликация, обеспечение RPO/RTO и валидация бэкапов
Масштабирование GitOps (ArgoCD: app-of-apps, ApplicationSet) и CI/CD пайплайнов в GitLab CI
Управление конфигурациями хостов через Salt (или Ansible) с упором на идемпотентность
Ротация секретов, ключей и сертификатов через HashiCorp Vault + External Secrets
Развитие систем мониторинга и алертинга (Prometheus, VictoriaMetrics, Grafana), расследование инцидентов
Устранение техдолга и актуализация runbook/документации для минимизации bus-factor

Необходимый опыт:
Опыт от 5 лет в DevOps/SRE/Platform, из них от 2 лет — с self-managed K8s в проде
Глубокий K8s: ручная сборка/апгрейд кластеров (kubeadm/kubespray), etcd, ротация сертификатов, PDB
Практический GitOps: ArgoCD (или Flux), управление селективным prune и рисками на stateful
Уверенное администрирование PostgreSQL в проде с Patroni и PITR
Опыт работы с конфигурационным менеджментом (SaltStack или Ansible) и GitLab CI
Уверенное знание Linux (systemd, сетевые лимиты, тюнинг ядра) и сетевой безопасности (Ingress, TLS)
Навыки автоматизации на Python / Bash / Go
Аккуратность с продом (обязательный dry-run и staging) и автономность — must have

Будет преимуществом:
Опыт работы с Cilium / eBPF-датаплейном (Kube-proxyless) и Hubble
Построение мультирегиональной связности (IPSec/WireGuard, DNS split-horizon)
Опыт работы в iGaming / highload-финтех (анти-DDoS, WAF Cloudflare)

Условия работы:
Конкурентная заработная плата;
Постоянная индексация заработной платы;
Среда, свободная от бюрократии;
Удаленный формат работы;

Для резюме и вопросов: @HR_Anastasiaaar

@DevOpsSRE_Jobs
Публикатор: Aleks M
Обсуждение:
#резюме

Формат работы: удаленка

Занятость: полная

Ожидания по зарплате: от 200 000 руб (обсуждается)

Технический стек: Linux, Docker, Kubernetes, Helm, Terraform, Ansible, GitHub Actions, Prometheus, Grafana, Zabbix, AWS (EC2, S3), Python, Bash, PowerShell, PostgreSQL, MS SQL Server, VMware, Hyper-V, Proxmox, Active Directory, сети (TCP/IP, VLAN, VPN, Cisco, MikroTik)

Обо мне: системный и инфраструктурный инженер с 17-летним опытом (Linux/Windows, сети, виртуализация, отказоустойчивые кластеры), последний год целенаправленно развиваюсь в сторону DevOps. Реализовал полный практический pipeline: Docker, Kubernetes, CI/CD через GitHub Actions, Terraform, мониторинг через Prometheus/Grafana, Helm chart для деплоя. Многолетний реальный опыт с Zabbix, VMware, PostgreSQL. Ищу позицию DevOps-инженера (Junior/Middle) с возможностью применить сильную инфраструктурную базу и расти в направлении контейнеризации, CI/CD и IaC.

Резюме (PDF): https://github.com/xwarhamx/-devops-project777/commit/50bac7b862188055a40701f4312cd0dbaba74e88

Репозиторий с pipeline: github.com/xwarhamx/-devops-project777

Контакты: +7 995 090-69-80, aleksandrmar87@gmail.com (mailto:aleksandrmar87@gmail.com)

@DevOpsSRE_Jobs
Публикатор: Petruha
Обсуждение:
#резюме #devops #sre #baremetal #llm

Позиция: Platform / Infrastructure Engineer (Middle)
Формат: удалённо (нахожусь в Грузии, готов к релокации)
Занятость: полная
Оформление: обсуждаемо, спокойно принимаю оплату криптой (USDT и др.)
Ожидания: обсуждаемо

Обо мне:

Основной инженер production-инфраструктуры enterprise-платформы для 5 клиентов (образование, производство, транспорт): 12 Kubernetes-кластеров, 45 нод, ~10K RPS, uptime 99.85%. Работаю в связке с тимлидом: архитектурные решения принимаем вместе, реализация и эксплуатация на мне, от сборки железа и установки сервера в ЦОДе клиента до GitOps-пайплайнов, бэкапов и on-call.

Ключевое:
- Построил внутреннюю LLM-платформу аналитики инфраструктуры с нуля: пайплайн нормализации событий K8s и метрик Prometheus в Qdrant, RAG-слой (Nomic Embed Text v2 + reranker, тюнинг chunk sizing), LLM-based sanity checks на каждом этапе (DeepSeek primary, Gemini fallback). Бенчил llama.cpp, vLLM, Transformers, остановился на Qwen 3.5 на llama.cpp. Автоматические аномалии, графики, новые варнинги за неделю. Перевёл мониторинг с реактивного (только critical) на проактивный: поймали деградирующий диск в проде до отказа. Используется ежедневно.

- Собрал и запустил on-prem кластер у security-sensitive клиента: сам собрал Supermicro-сервер, смонтировал в ЦОДе клиента, вывел в его закрытую сеть через WireGuard.

- Построил внутреннюю систему трекинга полевых работ для 2 enterprise-клиентов (100+ зданий): FastAPI-бэкенд, Grafana-дашборды с картой и автоматической маршрутизацией заявок. Срок решения проблем на объектах сократился с месяцев до недели.

- Развил CI/CD от "одна джоба: build" до полного цикла: линт и тесты до сборки, сборка, интеграционные тесты, деплой через ArgoCD, откат при необходимости. Релизы с еженедельных до ежедневных, ручных деплоев в прод: ноль

- Забрал 25 микросервисов из зоопарка ручных деплоев на VMware-виртуалках и перевёз их на самостоятельно построенные k3s-кластеры: управляемые окружения вместо "у каждого разработчика своя ВМ".

- Нашёл и онбордил полевого инженера для деплоя на кампусе из 55 корпусов, менторил по сетевой инфраструктуре.

- Отвечаю за бэкапы и disaster recovery всех кластеров: PostgreSQL с point-in-time recovery (WAL), репликация в multi-region S3. Восстановление отработано на реальных production-инцидентах.

- После ухода MinIO из open-source мигрировал хранилище на Rook/Ceph: прототип на k3s в AWS (Terraform), после проверки решения раскатил на все продовые bare-metal кластеры.

Стек:
Kubernetes (bare-metal, k3s) · Helm · Kustomize · ArgoCD · GitLab CI · Terraform · Ansible · AWS · Selectel · Rook/Ceph · Cilium · MetalLB · WireGuard · Prometheus · Grafana · Loki · VictoriaMetrics · PostgreSQL · MongoDB · ClickHouse · Python · Bash · FastAPI · llama.cpp · vLLM · Ray · Qdrant

Английский: C1

Контакт: @ptruha

@DevOpsSRE_Jobs
Публикатор: Julia
Обсуждение:
#вакансия
Город и адрес офиса: EU / Remote (работа в часовом поясе Европы)
Формат работы: 100% Remote (из стран EU)
Занятость: Полная (1 FTE)
Зарплатная вилка: 4000-8.000$
Особенности найма: Проектная занятость: до конца 2026 года с высокой вероятностью продления до июня 2027 г.
Языки: Английский или Польский (B2).
Работа в международной распределенной команде над долгосрочным проектом по безопасности.
Описание вакансии: Ищем опытного PKI & Cryptography Specialist для участия в долгосрочном security-проекте, сфокусированном на управлении криптографическими ключами и сертификатами.
Если вы умеете наводить порядок в PKI-инфраструктуре, контролировать жизненный цикл секретов и следить за крипто-гигиеной — эта роль для вас! Вам предстоит отвечать за полный аудит, учет и безопасность криптографических активов компании, а также оптимизировать процессы ротации и хранения секретов.
Наш стек:
PKI / TLS / mTLS
HSM (Hardware Security Module)
KMS (HashiCorp Vault и др.)
Key & Certificate Lifecycle Management
Чем предстоит заниматься:
Вести и актуализировать реестр всех криптографических ключей, сертификатов и секретов.
Аудировать и контролировать жизненный цикл ключей/сертификатов (генерация, ротация, обновление, отзыв, архивация).
Проверять сроки действия сертификатов и графики ротации ключей.
Контролировать матрицы доступа к ключам и секретам.
Анализировать условия хранения (HSM / KMS) и используемые криптоалгоритмы/длины ключей.
Настраивать и поддерживать протоколы TLS / mTLS.
Требования к кандидату:
Глубокое понимание практической криптографии и стандартов PKI.
Опыт работы с TLS / mTLS и управления жизненным циклом сертификатов.
Навыки работы с HSM (Hardware Security Module) или KMS (Key Management Systems, HashiCorp Vault и др.).
Опыт аудита доступов к секретам и паролям.
Нахождение в часовом поясе Европы (EU).
Рабочий уровень английского или польского языка.
Название компании: Top Selection
Контакты: @yul_shuk

@DevOpsSRE_Jobs
Публикатор: Daniil (JT)
Обсуждение:
#вакансия #vacancy #teamlead #devops #sre #platform #kubernetes #aws #iGaming

Вакансия: Team Lead DevOps
Компания: iGaming (NDA)
Грейд: lead
Вилка по ЗП: от 5000$ до 8000$
Тип занятости: полная
Формат работы: удалённый из любой точки мира

О КОМПАНИИ:
Продуктовая iGaming-компания с высоконагруженной инфраструктурой и частыми релизами. Мы проходим трансформацию из быстрорастущего стартапа в зрелую инженерную организацию
Команда разработки - более 30 человек, продукт переходит на новую архитектуру

О РОЛИ:
Ищем hands-on Team Lead Platform / DevOps / SRE, который возглавит платформенную команду. Задача - не только стабильность инфраструктуры, но и развитие платформы как внутреннего продукта: единые инженерные подходы, golden paths и переиспользуемые решения вместо разрозненных процессов в разных командах.

Роль сочетает техническое лидерство, управление командой и активное участие в развитии платформы.

ОСНОВНЫЕ ЗАДАЧИ:
1) Развитие команды (≈30% времени)
Развивать инженеров через регулярную обратную связь, менторинг и индивидуальные планы развития
Участвовать в найме и формировании сильной платформенной команды
Определять технические стандарты и контролировать их соблюдение
Управлять приоритетами между запросами продуктовых команд и развитием платформы
Формировать и реализовывать roadmap развития платформы

2) Развитие платформы (≈70% времени)
Развивать golden paths и переиспользуемые модули (Terraform, Helm) для быстрого запуска сервисов
Развивать и поддерживать платформу на базе AWS и Kubernetes
Развивать CI/CD как платформенный продукт: единые шаблоны GitLab CI, GitOps-подход к деплою
Развивать observability: Prometheus, Grafana, Loki, Alertmanager, distributed tracing
Развивать сетевую архитектуру и безопасность: VPC, VPN, балансировка нагрузки, управление секретами
Внедрять SRE-практики: SLO, error budgets, эффективный on-call процесс
Сокращать time-to-production и снижать когнитивную нагрузку на команды разработки

ЧТО МЫ ОТ ВАС ОЖИДАЕМ:
Опыт руководства командой DevOps / SRE / Platform Engineers
Практический опыт работы с AWS (EKS, RDS, VPC, IAM, S3)
Опыт эксплуатации Kubernetes в production (Helm, Ingress, StatefulSets, Operators)
Ежедневная работа с Terraform, Ansible и Helm
Опыт построения CI/CD (GitLab CI или аналоги) и понимание GitOps-подхода
Хорошее понимание сетевых технологий: TCP/IP, L4/L7 балансировка, VPN, container networking
Уверенное администрирование Linux, диагностика производительности и сети (strace, perf, tcpdump)
Bash и Python на уровне написания инструментов автоматизации
Опыт построения инженерных процессов, стандартов и масштабирования платформенной команды

БУДЕТ ПРЕИМУЩЕСТВОМ:
Практический опыт GitOps (ArgoCD, Flux)
OpenTelemetry и distributed tracing
Решения для управления секретами (Vault, SOPS, AWS Secrets Manager)
Зрелые SRE-практики: SLO, error budgets, построение on-call процессов
Опыт FinOps в AWS
Работа со stateful-сервисами в Kubernetes (PostgreSQL, Kafka, Redis и операторы)

ЧТО МЫ ГОТОВЫ ПРЕДЛОЖИТЬ:
Гибкое начало рабочего дня;
Удаленная работа из любой точки мира;
Оформление по Service Agreement
20 рабочих дней отпуска в год;
Полностью оплачиваемый больничный;
Оплачиваемые sick-days и days-off
Зарплата с привязкой к доллару и выплачивается в USDT.

@DevOpsSRE_Jobs
Публикатор: Vadim Nekrasov
Обсуждение:
#резюме

Позиция: DevOps-инженер
Формат: удалённо, гибрид
Локация: Санкт-Петербург, Россия
Занятость: full-time, part-time
Оформление: обсуждаемо
Ожидания: 180000 руб
Контакт: @VadoooS_S

Обо мне:
3 года опыта в продуктовой IT. Работал как единственный DevOps на 5 проектах одномоментно . Закрывал инфраструктуру, CI/CD, Kubernetes, observability, секреты и автоматизацию.

Основной фокус:
— CI/CD в GitLab CI
— Kubernetes
— observability: Prometheus, Grafana, Loki, Alertmanager
— IaC: Terraform
— автоматизация: Ansible
— секреты и доступы: HashiCorp Vault
— базы данных: PostgreSQL, mongoDB
HA, backup/restore
— безопасность: RBAC, NetworkPolicy, Pod Security
— облачная и не только инфраструктура: Yandex Cloud, proxmox

Практический опыт:
— Крутил нейронки для для трекинга лиц на експо форумах. На tesla T4

— создал удобную админку для управления терминалами скуда
— разрабатывал mvp модели новых систем
— кодил vpn для роутеров на openwrt
— делал nfs считывалки на ардуино
— настраивал локальную инфраструктуру в цоде компании
— принимал участие в разработке инфраструктуры новых продуктов
— ездил как sre на мероприятия для контроля монтажников и администраторов
— Внедрил в проект cdn и k8s. Внедрил нормальную работу локальной реплики с облачным кластером для мероприятий с первыми лицами государства с отключением интернета. Сократил время релизов примерно на 20%.Настроил Terraform-инфраструктуру в Yandex Cloud и proxmox. Автоматизировал кластеры, сеть, DNS, балансировщики и IAM. ( СКУД ПМЭФ И central asia expo)
— Внедрил Prometheus, Grafana, Loki и Alertmanager, blackbox.
Сократил время обнаружения инцидентов до 3 минут.
— Оптимизировал GitLab CI. Разделил stages, добавил кэширование и параллельные джобы. Встроил sast-сканирование образов. Сократил среднее время сборки с 10 до 3-5 минут.
— Развернул HashiCorp Vault. Настроил Kubernetes auth, AppRole и delivery секретов через Agent Injector.

Стек:
Linux, Docker, Kubernetes, GitLab CI, Terraform, Ansible, Vault, Prometheus, Grafana, Loki, Alertmanager, PostgreSQL, Yandex Cloud, Nginx, RabbitMQ, Redis, Bash, Python, Go.

Что ищу:
Интересуют задачи по развитию и поддержке инфраструктуры. Автоматизирую все что можно.

@DevOpsSRE_Jobs
Публикатор: Тatiana
Обсуждение:
#вакансия

DevOps/SRE Engineer (Proxy)

Company: SOAX
Remote (Except Belarus, Russia)
Full-time, On-call rotation
Range:50k-70k EUR gross, negotiable
B2B Contract (Deel)

SOAX is a proxy infrastructure company with a product customers genuinely love and depend on. Our system is a geo-distributed, high-load platform written in Go, handling HTTP/HTTPS/SOCKS5/TCP/UDP traffic across millions of nodes worldwide.

What you're walking into
- A geo-distributed system routing proxy traffic across bare-metal nodes globally — millions of nodes, real traffic, real money riding on it.
- The tangle we mentioned: overlapping fixes, inconsistent patterns, and infrastructure that works but wasn't always built the same way twice.
- Low-level networking challenges: routing, load balancing, protocol-level debugging.
- A lean team where your impact is immediately visible.
- An on-call rotation shared with one other engineer.

What you'll actually do
• Troubleshoot and fix things. Incidents happen. You dig in, find root causes, and resolve them — not "coordinate the response," but actually do the work.
• Rebuild infrastructure properly. Take what we have and make it production-grade: monitoring, alerting, deployment pipelines, disaster recovery.
• Work at the network level. Debug packet flows, optimize routing, understand why latency spikes between nodes in different regions. This is not a "deploy containers and forget" role.
• Automate everything that should be automated. If you're doing something manually twice, build a system for it.
• Drive your own strategic projects. Beyond firefighting, you'll identify what needs fixing at a structural level, propose it, get alignment, and own it end-to-end. This isn't a role where someone else does all the thinking and hands you a backlog.

What we need from you (non-negotiable)
• Networking fundamentals you can defend live — subnetting, NAT, routing, DNS, TLS. Not textbook definitions, but the ability to reason through a scenario out loud.
• Real bare-metal experience — actual hands-on with physical infrastructure at some point in your career.
• DevOps as genuine curiosity, not just a job — something you built or broke on your own time, not because a ticket told you to.
• A proven root-cause habit — a specific story where you found the actual cause of an issue, not just where you patched the symptom.
• 5+ years hands-on in DevOps / SRE / Infrastructure roles. (3–5 years are welcome to apply, but should be ready to demonstrate senior-level systems thinking live.)
• Comfort with on-call and incident response.

Strong plus
- Proxy protocols, traffic routing at scale, or CDN/edge experience.
- Self-hosted ClickHouse, Redis, Kafka, MongoDB.
- English good enough for a live technical conversation; Russian is a plus but not required.

What we offer
• Fully remote, four-day work week.
• Compensation paid in GBP.
• Reporting directly to the CTO.
• Paid time off and sick leave.

Contacts: @awwtanya

@DevOpsSRE_Jobs
Публикатор: Artem Avsievich
Обсуждение:
#вакансия #vacancy

Позиция: DevOps
Город: Баку
Формат работы: Удалёнка за пределами Азербайджана или офис в Баку
Занятость: Полная
Зарплатная вилка: 3000 EUR - 5000 EUR Gross
Язык: Английский C1
Особенности найма: Не нанимаем с территории РФ, РБ, Армении
Описание вакансии: https://31c.io/careers

About the Role:

We are looking for a Senior DevOps Engineer who can design, implement, and optimize a fully automated CI/CD and Kubernetes-based delivery ecosystem. You will empower developers, improve release reliability, and define DevOps practices company-wide.

Key Responsibilities:

Architect robust GitLab CI/CD workflows for multi-stage builds, tests, and deployments.
Define containerization standards and manage Docker image lifecycle for multiple services.
Lead design and operations of Kubernetes clusters, including networking, ingress, storage, and scaling.
Build standardized and immutable OS environments using Talos.
Maintain and extend Prometheus and Grafana-based observability systems.
Drive automation across the entire SDLC, eliminating manual processes.
Improve developer productivity with tooling, templates, pipelines, and automation.
Contribute to reliability engineering efforts, SLOs, performance monitoring, and failure analysis.

Requirements:

7+ years in DevOps or infrastructure automation.
Deep expertise with GitLab CI, Docker, and Kubernetes in production environments.
Experience with immutable infrastructure tools such as Talos.
Strong scripting abilities in Bash and at least one other language (Python, Go preferred).
Solid understanding of Prometheus, Grafana, and operational metrics.
Ability to design reliable, secure, and scalable delivery architectures with minimal oversight.
Strong ownership mindset and ability to lead initiatives independently.

Название компании: 31С
Ссылка на сайт компании: https://31c.io/
Контакты: @artem_avsievich
email: artem.avsievich@31c.io (mailto:artem.avsievich@31c.io)

@DevOpsSRE_Jobs