Публикатор: Игорь Быков (компания не указана)
DevOps Engineer
Публикатор: Игорь Быков Обсуждение: @devops_jobs #резюме Позиция: DevOps-инженер Формат: удалённо, гибрид Локация: Санкт-Петербург, Россия Занятость: full-time, part-time Контакт: @an3k0t Опыт: - Развертывание, настройка и эксплуатация production-инфраструктуры на базе Kubernetes. - Администрирование Linux-систем, контейнерной инфраструктуры Docker/Kubernetes, сетевых компонентов и хранилищ.- Разработка и сопровождение CI/CD процессов для автоматизации сборки, тестирования и доставки приложений (GitLab CI/CD, GitVerse). - Автоматизация инфраструктуры с использованием Infrastructure as Code подходов (Helm, Helmfile, Ansible).- Разработка и сопровождение Helm chart для развертывания приложений в Kubernetes. - Настройка мониторинга, логирования и анализа состояния сервисов (Prometheus, Grafana, Loki, Alloy). - Настройка сбора метрик, алертинга и контроль состояния production-сервисов. - Реагирование на инциденты, поиск причин неисправностей (Root Cause Analysis) и устранение проблем. - Настройка резервного копирования данных сервисов на удаленные серверы с использованием Restic. - Взаимодействие с командами разработки для улучшения процессов доставки и эксплуатации. Достижения: - Реализовал CI/CD pipeline для автоматического развертывания изолированных тестовых стендов от любой feature-ветки проекта. Pipeline динамически создавал окружение, максимально приближенное к production, включая адаптацию конфигурации приложения для локальной замены интеграций с AWS и S3, обновлял конфигурацию Nginx с выделением домена для каждого стенда. Для отслеживания создал внутренний интерфейс на базе GitLab API для управления и просмотра развернутых окружений. - Развернул и настроил GitVerse Runner в Kubernetes с разработкой собственного Helm chart для автоматизации CI/CD процессов. - Внедрил CrowdSec для защиты инфраструктуры, разработал кастомные сценарии обнаружения угроз на основе анализа логов сервисов. - Развернул и настроил production Kafka cluster с SASL-аутентификацией и ACL-политиками доступа. - Настроил управление Kafka-топиками, producer/consumer взаимодействие и эксплуатацию кластера. - Разработал кастомные Ansible роли для автоматизации развертывания Kafka UI и синхронизации Nginx-конфигураций. - Настроил систему мониторинга и логирования сервисов на базе Prometheus, Grafana, Loki и Alloy. - Провел анализ и нейтрализацию распределенной scraping-атаки на production-систему, восстановил стабильность работы сервисов. технологический стек: Linux: Ubuntu, Debian, CentOS/RHEL Containerization: Docker, Kubernetes, kubectl IaC: Helm, Helmfile, Ansible, Terraform (базовые знания) CI/CD: GitLab CI/CD, GitVerse, GitLab Runner, GitVerse Runner Cloud: AWS (EC2, S3, IAM), VK Cloud Monitoring: Prometheus, Grafana, Loki, Alloy Messaging: Apache Kafka (SASL, ACL) Web: Nginx, Apache Backup: Restic Security: CrowdSec Практики: Infrastructure as Code, Incident Response