Публикатор: степа

📍 Самара 🌍 Россия IT и разработка 16.09.2026 · 👁 719 просмотров
Публикатор: степа Обсуждение: @devops_jobs #резюме #devops #sre #kubernetes #gitops #observability #remote #удаленка SRE / DevOps Engineer Локация: Россия, Самара Формат работы: удалённо Опыт: 1 год 3 месяца коммерческого опыта Обо мне: SRE / DevOps-инженер с коммерческим опытом эксплуатации Kubernetes-инфраструктуры, CI/CD, мониторинга и сопровождения production-сервисов. Самостоятельно сопровождаю Kubernetes, разбираю инфраструктурные инциденты, автоматизирую эксплуатационные задачи и стандартизирую сборку и развёртывание приложений. Практический опыт: - Самостоятельно сопровождаю 2 Kubernetes-кластера: около 300 pod'ов, 20-30 микросервисов и несколько десятков виртуальных машин. - Сопровождал приложения в Kubernetes, участвовал в обновлении кластеров, анализировал состояние сервисов по Grafana, метрикам и логам. - Перестроил процесс сборки и выпуска приложений: перевёл проекты с Jenkins на GitLab CI, шаблонизировал пайплайны, настроил rules/needs, версионирование образов, сборку Helm-чартов и публикацию в Nexus. - Развернул ArgoCD и перевёл приложения под его управление; писал и перерабатывал Helm-чарты, создал umbrella chart для единого развёртывания стека мониторинга. - Развернул HashiCorp Vault с нуля в Kubernetes через Helm в отказоустойчивой конфигурации с Raft и настроил интеграцию приложений через External Secrets Operator. - Внедрил Gitleaks через общий шаблон GitLab CI примерно в 15-20 репозиториях. - Объединил мониторинг Kubernetes и виртуальных машин на Prometheus/VictoriaMetrics, перенёс мониторинг VM в кластер и переработал Alertmanager, снизив шум уведомлений. - Повышал устойчивость Kubernetes-сервисов с помощью HPA, PDB, PriorityClass, настройки ресурсов и стратегий обновления; использовал cordon/drain для безопасного вывода проблемных нод. - Диагностировал инфраструктурные инциденты: высокий fsync у etcd, HTTP 503, проблемы Redis Sentinel/HAProxy и Nginx, OOM, заполнение дисков, ошибки DNS, TLS и сетевой фильтрации. - Диагностировал сбои и проблемы с памятью Java-приложений в Linux по метрикам, системным и прикладным логам. - Оптимизировал сборку контейнеров с помощью multi-stage Dockerfile и прокси-кэша Python-пакетов. - Разработал Python-инструмент для ежедневной проверки сервисов, сбора диагностики и формирования отчёта. Стек: Kubernetes / Platform: Kubernetes, Helm, ArgoCD, Docker, Istio, Nginx, RBAC, etcd CI/CD: GitLab CI, Jenkins, Nexus, Gitleaks, Git Мониторинг: Prometheus, VictoriaMetrics, Grafana, Loki, Alertmanager, Sentry Секреты и данные: HashiCorp Vault, External Secrets Operator, PostgreSQL, Patroni, PgBouncer, Redis Sentinel, Kafka, Ceph/S3, SeaweedFS Автоматизация: Python, Bash, Linux Образование: Самарский национальный исследовательский университет имени академика С. П. Королёва Информатика и вычислительная техника Окончание - 2027 Языки: Русский - родной Английский - B1 Telegram: @relaxxx89 Email: stepaefimov@gmail.com
Откликнуться в Telegram →

⚠️ Никогда не платите «за оформление» или «гарантию трудоустройства» — это признак мошенников. Работа ТРУ не несёт ответственности за содержание вакансии.

🇮🇱 Не нашли подходящую зарплату? В Израиле платят от $3000 Без языка и опыта · жильё и легализация под ключ · официально Смотреть вакансии →