Публикатор: Игорь Быков
Публикатор: Игорь Быков
Обсуждение:
@devops_jobs
#резюме
Позиция: DevOps-инженер
Формат: удалённо, гибрид
Локация: Санкт-Петербург, Россия
Занятость: full-time, part-time
Контакт:
@an3k0t
Опыт:
- Развертывание, настройка и эксплуатация production-инфраструктуры на базе Kubernetes.
- Администрирование Linux-систем, контейнерной инфраструктуры Docker/Kubernetes, сетевых компонентов и хранилищ.- Разработка и сопровождение CI/CD процессов для автоматизации сборки, тестирования и доставки приложений (GitLab CI/CD, GitVerse).
- Автоматизация инфраструктуры с использованием Infrastructure as Code подходов (Helm, Helmfile, Ansible).-
Разработка и сопровождение Helm chart для развертывания приложений в Kubernetes.
- Настройка мониторинга, логирования и анализа состояния сервисов (Prometheus, Grafana, Loki, Alloy).
- Настройка сбора метрик, алертинга и контроль состояния production-сервисов.
- Реагирование на инциденты, поиск причин неисправностей (Root Cause Analysis) и устранение проблем.
- Настройка резервного копирования данных сервисов на удаленные серверы с использованием Restic.
- Взаимодействие с командами разработки для улучшения процессов доставки и эксплуатации.
Достижения:
- Реализовал CI/CD pipeline для автоматического развертывания изолированных тестовых стендов от любой feature-ветки проекта. Pipeline динамически создавал окружение, максимально приближенное к production, включая адаптацию конфигурации приложения для локальной замены интеграций с AWS и S3, обновлял конфигурацию Nginx с выделением домена для каждого стенда. Для отслеживания создал внутренний интерфейс на базе GitLab API для управления и просмотра развернутых окружений.
- Развернул и настроил GitVerse Runner в Kubernetes с разработкой собственного Helm chart для автоматизации CI/CD процессов.
- Внедрил CrowdSec для защиты инфраструктуры, разработал кастомные сценарии обнаружения угроз на основе анализа логов сервисов.
- Развернул и настроил production Kafka cluster с SASL-аутентификацией и ACL-политиками доступа.
- Настроил управление Kafka-топиками, producer/consumer взаимодействие и эксплуатацию кластера.
- Разработал кастомные Ansible роли для автоматизации развертывания Kafka UI и синхронизации Nginx-конфигураций.
- Настроил систему мониторинга и логирования сервисов на базе Prometheus, Grafana, Loki и Alloy.
- Провел анализ и нейтрализацию распределенной scraping-атаки на production-систему, восстановил стабильность работы сервисов.
технологический стек:
Linux: Ubuntu, Debian, CentOS/RHEL
Containerization: Docker, Kubernetes, kubectl
IaC: Helm, Helmfile, Ansible, Terraform
CI/CD: GitLab CI/CD, GitVerse, GitLab Runner, GitVerse Runner
Cloud: AWS (EC2, S3, IAM), VK Cloud
Monitoring: Prometheus, Grafana, Loki, Alloy
Messaging: Apache Kafka (SASL, ACL)
Web: Nginx, Apache
Backup: Restic
Security: CrowdSec
Практики: Infrastructure as Code, Incident Response
Откликнуться в Telegram →
⚠️ Никогда не платите «за оформление» или «гарантию трудоустройства» — это признак мошенников. Работа ТРУ не несёт ответственности за содержание вакансии.