Эксперт по надежности (SRE)
Описание
Чем предстоит заниматься обеспечивать отказоустойчивость инфраструктуры и автоматическое восстановление сервисов при сбоях настраивать дашборды и пороги алертинга для контроля состояния платформы проектировать, внедрять и поддерживать метрики и трейсы для мониторинга оперативно реагировать и устранять инциденты, участвовать в дежурствах (On-call) и проводить post-mortem разборы повышать наблюдаемость систем разрабатывать стратегии Disaster Recovery управлять контейнерными средами и оркестрацией в Kubernetes работать с базами данных (написание запросов, диагностика производительности) обеспечивать централизованный сбор и анализ логов Наши ожидания контейнеризация: Docker и Kubernetes (опыт работы и разворачивания) мониторинг: Prometheus / VictoriaMetrics и Grafana Infrastructure as Code: Ansible, Helm CI/CD: GitLab и GitLab CI умение работать с трассировкой и метриками логирование: ELK, EFK, OpenSearch или альтернативы Nginx, HAproxy, keepalived умение писать скрипты на Bash и Python уверенное знание Linux-систем и их администрирование умение работать с СУБД (Redis, MongoDB) будет плюсом опыт работы с Java-приложениями навыки чтения кода на PHP Мы предлагаем официальное трудоустройство по ТК РФ с первого дня работы стабильный и прозрачный доход (размер заработной платы обсуждается по результатам собеседования) карьерный рост: прозрачная система грейдов, система наставничества, обучение, чтобы поделиться с тобой экспертизой заботу о твоем здоровье: подключение ДМС после испытательного срока материальную помощь в различных жизненных ситуациях формат работы — удаленно или гибрид Хочешь стать частью команды Банка Уралсиб? Откликайся прямо сейчас! Наша вакансия тебе подойдет, если ты ищешь:DevOps-инженер, SRE