Публикатор: /home/anon
Публикатор: /home/anon
Обсуждение:
@devops_jobs
#резюме
#ищу
#sre
#devops
#kubernetes
#gitops
#middle
#fulltime
#remote
Степан — SRE / DevOps Engineer
Локация: Самара, Россия
Формат: удалённо
Занятость: полная
Опыт в IT: 3+ года
Обо мне:
SRE / DevOps-инженер с опытом эксплуатации production-инфраструктуры, развития CI/CD и GitOps, мониторинга и обеспечения отказоустойчивости сервисов.
В текущем проекте самостоятельно сопровождаю и развиваю 2 Kubernetes-кластера (~300 pod, 20–30 микросервисов) и несколько десятков виртуальных машин. Отвечаю за эксплуатацию инфраструктуры, релизы, мониторинг, диагностику инцидентов и развитие платформы.
Ключевые задачи и достижения:
— Перестроил CI/CD: перевёл проекты с Jenkins на GitLab CI, разработал универсальные пайплайны со сборкой Docker-образов, тестированием, публикацией в Nexus и развёртыванием через Helm. Ускорил выпуск типовых релизов примерно в 1,5 раза.
— Внедрил ArgoCD и GitOps-подход, унифицировал Helm-чарты и упростил процесс доставки приложений в Kubernetes для команд разработки.
— Мигрировал с ingress-nginx на Istio Gateway API (Gateway/HTTPRoute), обновив схему маршрутизации внешнего трафика и устранив зависимость от неподдерживаемого ingress-контроллера.
— Развернул отказоустойчивый кластер HashiCorp Vault (3 узла, Raft) и интегрировал его с Kubernetes через External Secrets Operator. Централизовал управление секретами и доступом к ним.
— Внедрил Gitleaks в 20+ проектов через общие шаблоны GitLab CI для автоматического обнаружения секретов в репозиториях.
— Объединил мониторинг Kubernetes и VM на Prometheus / VictoriaMetrics / Grafana. Переработал правила Alertmanager, снизил шум алертов примерно на 40%, добавил ссылки на дашборды и runbook. Создал единый Helm umbrella-chart для компонентов мониторинга.
— Повышал отказоустойчивость Kubernetes-сервисов: настраивал HPA, PDB, PriorityClass, requests/limits и RollingUpdate. Выполнял обслуживание нод через cordon/drain без остановки сервисов.
— Диагностировал и устранял production-инциденты, связанные с etcd, PostgreSQL/Patroni, Redis Sentinel, HAProxy, DNS, TLS, OOM, дисковой подсистемой и сетевым взаимодействием.
— Автоматизировал эксплуатационные задачи на Python и Bash: проверки доступности сервисов, сбор диагностической информации и рутинные операции с инфраструктурой.
Технологический стек:
Infrastructure: Linux, Kubernetes, Docker, Terraform, Helm, Istio, Nginx, HAProxy, Ceph/S3
CI/CD & GitOps: GitLab CI/CD, Jenkins, ArgoCD, Nexus, Git
Observability: Prometheus, VictoriaMetrics, Grafana, Alertmanager, Loki, Sentry
Security: HashiCorp Vault, External Secrets Operator, Gitleaks
Databases & Messaging: PostgreSQL, Patroni, PgBouncer, Redis Sentinel, etcd, Kafka
Automation: Python, Bash, Ansible
Английский: B1
Контакт:
@homeanonn
Откликнуться в Telegram →
⚠️ Никогда не платите «за оформление» или «гарантию трудоустройства» — это признак мошенников. Работа ТРУ не несёт ответственности за содержание вакансии.