Публикатор: Диас
Публикатор: Диас
Обсуждение:
@devops_jobs
#резюме
#devops
#sre
#platform
#junior
#middle
DevOps / SRE / Platform Engineer
Junior+ / Middle
Москва
Офис / гибрид / удалёнка, полная занятость
Ожидания: от 160 000 на руки
Ищу инженерную работу: CI/CD, IaC, автоматизация, надёжность. Дежурства и инциденты — ок. Первая линия и работа по инструкции — нет.
Опыт:
~ 1 год в Яндексе: SRE в Кинопоиске и DevOps / Release Engineer в Yandex Cloud (обе позиции — стажировки). В Yandex Cloud был единственным в команде, кто отвечал за релизы и CI/CD. Итог: в Кинопоиске предложили остаться в штате, в Yandex Cloud дали рекомендацию на middle DevOps.
Yandex Cloud, Network Block Storage (сетевые диски для ВМ) — DevOps Engineer
— Релиз шёл 2–3 недели, а IAM-токен в релизной туле на Go жил 12 часов. Разработчики перезапускали джобы в TeamCity руками, ночью и на выходных релиз простаивал до 18 часов. Добавил обновление токена перед каждым хостом, и релиз идёт без перезапусков.
— Релизы ещё и падали ровно через сутки. Докопался: TeamCityStage во внутреннем плагине Spinnaker не поддерживал timeout, и Spinnaker отменял джобу через 24 часа. Доработал плагин, им пользуются все команды Yandex Cloud.
— Нагрузочные тесты гоняли вручную: удалить старые тесты и ВМ, поднять новые, запустить, обновить дашборды. Встроил это этапом в релизный пайплайн, теперь достаточно выбрать тесты при запуске.
— Для этого переделал в Terraform схему сервисных аккаунтов и ролей: сервис и тесты живут в разных организациях, тесты идут в prod / preprod / test, build-агенты — только в prod. Согласовывал доступы со смежными командами.
— Закрыл в Spinnaker-пайплайне (Kotlin DSL) конфликт параметров сборки и выкатки. Наладил фиксацию версий бинарей в SaltStack, чтобы не выкатывалась не та версия.
Кинопоиск — SRE
— Сам вёл ИБ-проект: 300+ кластеров Managed Databases сидели в одном общем сетевом макросе, и компрометация одного хоста открывала доступ ко всем. Спроектировал схему и нейминг, завёл отдельный макрос на каждый кластер, заказал точечные сетевые доступы сервис → БД, смигрировал кластеры.
— Перевёл доступ к БД на bastion-хосты: доступы, настройка кластеров, работа с разработчиками по переезду, отрыв прямых доступов.
— Сделал сервис отказоустойчивым: перенёс с 1 ДЦ на 3 с балансировкой, поправил код, чтобы убрать конкурирующие транзакции.
— Мультиалертинг (шаблонизация алертов с едиными порогами) в Yandex Monitoring.
— Дежурства: сначала днём с коллегами, потом ночные самостоятельно.
Стек:
— Linux, сети, Nginx, TLS
— CI/CD: TeamCity, Spinnaker, Gitlab CI
— IaC и конфигурация: Terraform, SaltStack, Ansible
— Docker, Kubernetes (через Yandex Deploy + самостоятельно)
— Kafka, MinIO
— Prometheus, Grafana, Yandex Monitoring, Elasticsearch
— Python (основной), Go (правки в прод-коде), Bash
Образование:
— МГТУ им. Баумана, прикладная математика и информатика, 2026
— Школа SRE и DevOps Яндекса. Учебная задача: генерация дашборда на PostgreSQL с нескольких часов до 7 секунд (запросы, индексы, work_mem). Исследовал HTTP/1.1, 2, 3 и TCP congestion control (BBR / Cubic / Reno) под потерями и задержками.
Свои проекты:
— VPN-сервер с нуля: Trojan-Go, firewall с минимумом открытых портов, Nginx с fallback на заглушку для неавторизованных, автообновление Let's Encrypt, Prometheus + Grafana с алертами.
— В работе: агрегатор логов на Kafka → Elasticsearch / MinIO.
Контакт:
@DSIsakov
Откликнуться в Telegram →
⚠️ Никогда не платите «за оформление» или «гарантию трудоустройства» — это признак мошенников. Работа ТРУ не несёт ответственности за содержание вакансии.