Компания не указана
DevOps-инженер
1 нед. назад
RussiaHybrid
kubernetesdockerlinuxhelmhelmfileansiblegitlab ci/cdapache kafka
Позиция DevOps-инженера с возможностью удалённой и гибридной работы из Санкт-Петербурга. Вакансия предусматривает как полную, так и частичную занятость.
Обязанности
- Развертывание, настройка и эксплуатация production-инфраструктуры на базе Kubernetes.
- Администрирование Linux-систем, контейнерной инфраструктуры Docker/Kubernetes, сетевых компонентов и хранилищ.
- Разработка и сопровождение CI/CD процессов для автоматизации сборки, тестирования и доставки приложений (GitLab CI/CD, GitVerse).
- Автоматизация инфраструктуры с использованием Infrastructure as Code подходов (Helm, Helmfile, Ansible).
- Разработка и сопровождение Helm chart для развертывания приложений в Kubernetes.
- Настройка мониторинга, логирования и анализа состояния сервисов (Prometheus, Grafana, Loki, Alloy).
- Настройка сбора метрик, алертинга и контроль состояния production-сервисов.
- Реагирование на инциденты, поиск причин неисправностей (Root Cause Analysis) и устранение проблем.
- Настройка резервного копирования данных сервисов на удаленные серверы с использованием Restic.
- Взаимодействие с командами разработки для улучшения процессов доставки и эксплуатации.
Achievements
- Реализовал CI/CD pipeline для автоматического развертывания изолированных тестовых стендов от любой feature-ветки проекта с адаптацией конфигурации приложения и обновлением Nginx.
- Развернул и настроил GitVerse Runner в Kubernetes с разработкой собственного Helm chart для автоматизации CI/CD процессов.
- Внедрил CrowdSec для защиты инфраструктуры с кастомными сценариями обнаружения угроз на основе анализа логов сервисов.
- Развернул и настроил production Kafka cluster с SASL-аутентификацией и ACL-политиками доступа.
- Настроил управление Kafka-топиками, producer/consumer взаимодействие и эксплуатацию кластера.
- Разработал кастомные Ansible роли для автоматизации развертывания Kafka UI и синхронизации Nginx-конфигураций.
- Настроил систему мониторинга и логирования сервисов на базе Prometheus, Grafana, Loki и Alloy.
- Провел анализ и нейтрализацию распределенной scraping-атаки на production-систему, восстановил стабильность работы сервисов.
Требования
- Опыт работы с Linux (Ubuntu, Debian, CentOS/RHEL).
- Опыт работы с контейнеризацией Docker, Kubernetes, kubectl.
- Знания Infrastructure as Code: Helm, Helmfile, Ansible, базовые знания Terraform.
- Опыт работы с CI/CD системами: GitLab CI/CD, GitVerse, GitLab Runner, GitVerse Runner.
- Опыт работы с облачными сервисами AWS (EC2, S3, IAM) и VK Cloud.
- Опыт настройки мониторинга и логирования (Prometheus, Grafana, Loki, Alloy).
- Опыт работы с Apache Kafka (SASL, ACL).
- Знания веб-серверов Nginx, Apache.
- Опыт настройки резервного копирования (Restic).
- Знания систем безопасности CrowdSec.
- Понимание практик Infrastructure as Code, Incident Response.
Условия
- Формат работы: удалённо, гибрид.
- Локация: Санкт-Петербург, Россия.
- Занятость: full-time, part-time.