Kubernetes
#vacancy
#DevOps
#SRE
#Kubernetes
#DataLake
#Spark
#Flink
#Kafka
#Iceberg
#MinIO
#S3
#Senior
Главный DevOps-инженер (Data Lake / S3 / Kubernetes / Альфа-Банк)
🏦
⚙️
ID вакансии: A-169_Gul
Ставка: до 370 000 руб. на руки в месяц.
Грейд: Senior / Senior+.
Загрузка: Full-time (полная занятость).
Формат: Удалённо.
Часовой пояс:
строго МСК
.
Локация/Гражданство: РФ / РФ.
Заказчик:
Альфа-Банк
.
⏳
Срок актуальности вакансии:
до 12.08.2026.
📌
Важно:
рассматриваются кандидаты с релевантностью опыта от 85% (аутстаффинговая позиция).
🎯
Возможность:
со временем перевод в штат Альфа-Банка.
💬
Важный комментарий от заказчика:
«Не обязательно знать всё — таких людей найти сложно. Если кандидат знает хотя бы 50% из перечисленного, остальному можно будет обучить».
Ищем Главного DevOps-инженера для сопровождения и эксплуатации Data Lake платформ в Альфа-Банке. Роль для зрелого SRE-инженера с глубокой экспертизой в distributed storage, Kubernetes и Big Data-компонентах. Предстоит обеспечивать надёжность высоконагруженных систем, проводить RCA/postmortem, автоматизировать эксплуатацию и взаимодействовать с командами Data Engineering.
🚀
Ключевые задачи:
Сопровождение и эксплуатация Data Lake платформ.
Поддержка S3 / Object Storage инфраструктуры.
Мониторинг, диагностика и устранение инцидентов.
Troubleshooting производительности платформы и storage-систем.
Сопровождение Kubernetes и компонентов Data Lake: Apache Spark, Airflow, Flink, Kafka, Apache Iceberg.
Проведение RCA и postmortem analysis.
Автоматизация эксплуатационных задач.
Взаимодействие с командами Data Engineering и инфраструктуры.
Сопровождение Big Data Platform.
🎯
Самые критичные требования (приоритет при оценке):
Глубокое понимание S3 / Object Storage и distributed storage architecture.
Опыт сопровождения Kubernetes-платформ.
Практический опыт эксплуатации компонентов Data Lake: Apache Spark, Airflow, Flink, Kafka, Apache Iceberg.
Опыт эксплуатации MinIO / Object Storage решений.
🎯
Обязательные требования:
ОС и распределённые системы:
Экспертный опыт администрирования Linux.
Опыт сопровождения высоконагруженных distributed systems.
Хранилища:
Глубокое понимание S3 / Object Storage и distributed storage architecture.
Опыт эксплуатации MinIO / Object Storage решений.
Понимание replication, erasure coding, consistency, fault tolerance.
Kubernetes:
Опыт сопровождения Kubernetes-платформ.
Data Lake:
Практический опыт эксплуатации компонентов Data Lake: Apache Spark, Airflow, Flink, Kafka, Apache Iceberg.
Troubleshooting:
Практический опыт troubleshooting: CPU, RAM, network, disk I/O, latency, throughput.
Мониторинг:
Опыт работы с observability stack: Prometheus, Grafana, alerting, log analysis.
Автоматизация:
Опыт автоматизации: Ansible, Terraform, Bash, Python.
SRE-практики:
Понимание incident/problem management и SRE-практик.
Навыки RCA, postmortem analysis и повышения reliability платформ.
📲
Контакт для отклика:
@hrwomenpro
Откликнуться в Telegram →
⚠️ Никогда не платите «за оформление» или «гарантию трудоустройства» — это признак мошенников. Работа ТРУ не несёт ответственности за содержание вакансии.