Публикатор: степа
Публикатор: степа
Обсуждение:
@devops_jobs
#резюме
#devops
#sre
#kubernetes
#gitops
#observability
#remote
#удаленка
SRE / DevOps Engineer
Локация: Россия, Самара
Формат работы: удалённо
Опыт: 1 год 3 месяца коммерческого опыта
Обо мне:
SRE / DevOps-инженер с коммерческим опытом эксплуатации Kubernetes-инфраструктуры, CI/CD, мониторинга и сопровождения production-сервисов.
Самостоятельно сопровождаю Kubernetes, разбираю инфраструктурные инциденты, автоматизирую эксплуатационные задачи и стандартизирую сборку и развёртывание приложений.
Практический опыт:
- Самостоятельно сопровождаю 2 Kubernetes-кластера: около 300 pod'ов, 20-30 микросервисов и несколько десятков виртуальных машин.
- Сопровождал приложения в Kubernetes, участвовал в обновлении кластеров, анализировал состояние сервисов по Grafana, метрикам и логам.
- Перестроил процесс сборки и выпуска приложений: перевёл проекты с Jenkins на GitLab CI, шаблонизировал пайплайны, настроил rules/needs, версионирование образов, сборку Helm-чартов и публикацию в Nexus.
- Развернул ArgoCD и перевёл приложения под его управление; писал и перерабатывал Helm-чарты, создал umbrella chart для единого развёртывания стека мониторинга.
- Развернул HashiCorp Vault с нуля в Kubernetes через Helm в отказоустойчивой конфигурации с Raft и настроил интеграцию приложений через External Secrets Operator.
- Внедрил Gitleaks через общий шаблон GitLab CI примерно в 15-20 репозиториях.
- Объединил мониторинг Kubernetes и виртуальных машин на Prometheus/VictoriaMetrics, перенёс мониторинг VM в кластер и переработал Alertmanager, снизив шум уведомлений.
- Повышал устойчивость Kubernetes-сервисов с помощью HPA, PDB, PriorityClass, настройки ресурсов и стратегий обновления; использовал cordon/drain для безопасного вывода проблемных нод.
- Диагностировал инфраструктурные инциденты: высокий fsync у etcd, HTTP 503, проблемы Redis Sentinel/HAProxy и Nginx, OOM, заполнение дисков, ошибки DNS, TLS и сетевой фильтрации.
- Диагностировал сбои и проблемы с памятью Java-приложений в Linux по метрикам, системным и прикладным логам.
- Оптимизировал сборку контейнеров с помощью multi-stage Dockerfile и прокси-кэша Python-пакетов.
- Разработал Python-инструмент для ежедневной проверки сервисов, сбора диагностики и формирования отчёта.
Стек:
Kubernetes / Platform:
Kubernetes, Helm, ArgoCD, Docker, Istio, Nginx, RBAC, etcd
CI/CD:
GitLab CI, Jenkins, Nexus, Gitleaks, Git
Мониторинг:
Prometheus, VictoriaMetrics, Grafana, Loki, Alertmanager, Sentry
Секреты и данные:
HashiCorp Vault, External Secrets Operator, PostgreSQL, Patroni, PgBouncer, Redis Sentinel, Kafka, Ceph/S3, SeaweedFS
Автоматизация:
Python, Bash, Linux
Образование:
Самарский национальный исследовательский университет имени академика С. П. Королёва
Информатика и вычислительная техника
Окончание - 2027
Языки:
Русский - родной
Английский - B1
Telegram:
@relaxxx89
Email: stepaefimov@gmail.com
Откликнуться в Telegram →
⚠️ Никогда не платите «за оформление» или «гарантию трудоустройства» — это признак мошенников. Работа ТРУ не несёт ответственности за содержание вакансии.