Senior DevOps Engineer - Prometheus
DevOps Engineer
Публикатор: Eugeniy Обсуждение: @devops_jobs #вакансия #devops #linux #AWS #fulltime #remote #гибрид Вакансия: Senior DevOps Engineer Вилка: 4 000–10 000 USDT Стек: Linux, Python, AWS (AWS API), GitLab CI/CD, Prometheus, VictoriaMetrics, Grafana, Alertmanager, Loki, ELK, Ansible, Terraform, ClickHouse, systemd Занятость: полная Локация: Москва, возможны гибрид и удалённая занятость Senior DevOps Engineer Мы — технологичный HFT-фонд, работающий на международных финансовых рынках. Разрабатываем и эксплуатируем высокопроизводительные торговые системы, где критически важны скорость, стабильность и надёжность инфраструктуры. Ищем Senior DevOps Engineer, который возьмёт на себя развитие DevOps-направления. Это роль с высокой степенью ответственности и самостоятельности: вы будете отвечать за инфраструктуру, эксплуатацию и релизные процессы критически важных торговых систем, задавать инженерные стандарты и определять дальнейшее развитие направления. Нам нужен инженер, который не просто закрывает отдельные задачи, а способен взять направление под свой контроль, выстроить и улучшить процессы и отвечать за надёжность продакшена в целом. ЧТО ВЫ БУДЕТЕ ДЕЛАТЬ - Строить и поддерживать CI/CD: настраивать стабильные и быстрые пайплайны сборки и выкатки, автоматизировать релизы под разные стеки команд, обеспечивать безопасные деплои с минимальным даунтаймом. - Управлять продакшн-инфраструктурой (cloud + on-premise): настраивать и обслуживать серверы промышленной эксплуатации, окружения, обновления и конфигурации. Поддерживать прозрачный процесс доставки кода и понятное состояние систем для всех команд. - Повышать надёжность продакшена: работать с systemd, сетями и конфигурациями, участвовать в разборе инцидентов, предотвращать их повторение и внедрять эксплуатационные улучшения. - Работать в связке с трейдинг- и инфраструктурными командами: совместно проектировать решения, внедрять улучшения и обновления систем, участвовать в разборе инцидентов. ТРЕБОВАНИЯ Технический стек: - Глубокое знание Unix/Linux и опыт системного администрирования — инфраструктурные и эксплуатационные аспекты. - Уверенное владение Python. - AWS API — глубокое знание и практический опыт работы. - GitLab CI/CD — настройка и поддержка пайплайнов. - Prometheus/VictoriaMetrics, Grafana, Alertmanager, Loki/ELK — настройка, сбор, интеграция и отладка метрик, алертов и дашбордов. - IaC: Ansible/Terraform. - ClickHouse. Опыт и подход к эксплуатации: - Опыт самостоятельного вывода проектов в продакшн и их последующего сопровождения: CI/CD, тесты, мониторинг, алерты. - Понимание принципов надёжной продакшн-системы: SLA, uptime, fault tolerance, реакция на инциденты, безопасные деплои. - Готовность вести инфраструктурные задачи от диагностики проблемы до её решения в продакшене. - Умение находить баланс между производительностью и простотой и принимать инженерные решения с прицелом на сопровождаемость, расширяемость и отлаживаемость. - Самостоятельность и готовность брать ответственность за критически важные системы. - Умение расставлять приоритеты и переключаться между несколькими проектами. БУДЕТ ПРЕИМУЩЕСТВОМ - Опыт в сферах с высокими требованиями к надёжности и производительности: финансы, HFT и другие high-load/low-latency системы. - Опыт работы с высокопроизводительными или распределёнными системами хранения данных. - Понимание принципов работы сетей с высокой пропускной способностью. - Опыт с low-latency WAN: microwave/RF-линки, выделенные каналы между площадками. - Опыт работы с FPGA-инфраструктурой. - Опыт работы с AMD Solarflare Ethernet Adapters. - Высшее техническое образование (МФТИ, МГУ, МГТУ им. Баумана, ВШЭ). УСЛОВИЯ - Заработная плата: в долларах или рублях + прозрачная система бонусов. - ДМС. - Формат: современный офис в Москве; можно обсуждать гибридный или удалённый формат работы. - Гибкое начало рабочего дня. - Оборудование предоставляется. Для откликов и вопросов: @eugeniy_ggg