Lead DevOps / TATLIN.UNIFIED
Описание
Наш департамент - часть большой команды разработки флагманского продукта компании YADRO – TATLIN.UNIFIED. Продукт представляет собой современное хранилище, созданное для решения задач традиционных корпоративных приложений, больших данных и аналитики, которое используют в ЦОД, публичных и частных облаках. Обязанности:Управление командой Определять цели команды и переводить их в понятный план работ. Управлять приоритетами между развитием платформы, техническим долгом, сопровождением пользователей и устранением операционных проблем. Распределять зоны ответственности внутри команды и устранять зависимость критичных процессов от отдельных специалистов. Развивать инженеров: ставить задачи, давать обратную связь, определять зоны роста и поддерживать обмен знаниями. Участвовать в подборе сотрудников и формировании сбалансированной команды. Формировать прозрачную систему планирования и контроля результатов без микроменеджмента. Обеспечивать документирование архитектуры, процессов, эксплуатационных процедур и принятых решений. Развитие CI/CD-платформы Формировать техническое видение и целевую архитектуру CI/CD-платформы. Развивать унифицированные механизмы построения компонентов и продуктов, публикации артефактов и управления релизными конфигурациями. Сокращать количество ручных операций и частных решений в продуктовых командах. Развивать self-service-возможности платформы и стандартизировать типовые CI/CD-сценарии. Управлять техническим долгом и поэтапной модернизацией существующих решений. Обеспечивать масштабируемость, воспроизводимость и наблюдаемость процессов сборки. Определять границы ответственности платформенной и продуктовых команд. Эксплуатация и качество сервиса Обеспечивать работоспособность критичных CI/CD-сервисов и предсказуемое восстановление после сбоев. Выстраивать процессы мониторинга, обработки инцидентов, анализа причин и предотвращения повторных проблем. Определять и контролировать показатели качества сервиса: доступность, длительность процессов, количество ошибок, время реакции и восстановления. Разделять плановое развитие, пользовательскую поддержку и срочные эксплуатационные работы. Повышать прозрачность состояния платформы для пользователей и заинтересованных команд. Управлять зависимостями от инфраструктурных и смежных сервисов, фиксировать договорённости и эскалировать системные ограничения. Работать с руководителями разработки, архитекторами, Release Management, QA и инфраструктурными командами. Собирать и систематизировать потребности продуктовых команд, отделяя общие платформенные задачи от локальных запросов. Согласовывать приоритеты и объяснять ограничения, риски и стоимость принимаемых решений. Организовывать внедрение новых механизмов в продуктовые команды и контролировать результат. Выстраивать единые правила работы с CI/CD-платформой вместо поддержки множества индивидуальных исключений. Требования: Опыт руководства инженерной или платформенной командой. Опыт управления не только людьми, но и техническим направлением: архитектурой, планом развития, техническим долгом и эксплуатацией. Системное мышление: способность видеть сквозной процесс, находить первопричины и устранять класс проблем, а не только отдельные проявления. Умение работать с большим количеством зависимостей, заинтересованных сторон и конкурирующих приоритетов. Практическое понимание принципов CI/CD, построения и тестирования программных продуктов, управления артефактами и релизными процессами. Понимание принципов проектирования и эксплуатации внутренних платформ и сервисов. Опыт стандартизации процессов и создания переиспользуемых инженерных решений. Умение принимать решения в условиях неполной информации и доводить изменения до внедрения. Способность формулировать требования, фиксировать договорённости и поддерживать качественную техническую документацию. Умение конструктивно отстаивать архитектурные и организационные решения.