DevOps Senior
Описание
ЛИАН — системный интегратор с фокусом в аналитике и управлении данными. Мы работаем в трех направлениях: 1. Автоматизация управленческой отчетности (BI) в малом и среднем бизнесе. Строим хранилища данных, настраиваем сбор и интеграцию, разрабатываем отчеты и дэшборды. Наш стек в BI включает все современные инструменты, в том числе open-source ПО. 2. Заказная разработка аналитических систем. Когда у нашего клиента есть специфичный запрос, мы разрабатываем аналитические системы с нуля. Часто применяем подходы BigData, Data Science, актуальные подходы к программному анализу данных и прогнозированию. 3. Запуск и ресурсное обеспечение команд разработки в комплексных проектах цифровой трансформации. Мы усиливаем команды наших партнеров и клиентов собственными сотрудниками и обеспечиваем максимально быстрый старт новых проектов. Среди наших заказчиков - крупные системные интеграторы, банки, нефтегазовые, химические производства, логистические компании, стартапы. Сейчас мы приглашаем опытного devops инженера на проектную деятельность! Чем предстоит заниматься: Мониторинг OpenStack, участие в on-call-дежурствах, устранение критических инцидентов (P0/P1) и сбоев Nova/Neutron/Cinder/Ceph/Keystone/Glance, анализ логов, проведение root cause analysis, восстановление сервисов; Оптимизация производительности: настройка Nova (scheduler, NUMA, CPU pinning, hugepages), OVS/OVN (DPDK, SR-IOV, offloading), Ceph и планирование ресурсов (capacity planning); Развёртывание и миграции: проектирование и развёртывание OpenStack с нуля, обновление между версиями, миграция ВМ и данных с VMware/Hyper-V, масштабирование кластера без простоев; Сетевая инфраструктура: работа с Neutron, VLAN/VXLAN, tenant/provider-сети, BGP/EVPN, L3/DHCP/Metadata, Octavia, межсетевое экранирование и сегментация, диагностика потерь пакетов, асимметричной маршрутизации, MTU и conntrack; Хранилища данных: эксплуатация и масштабирование Ceph, работа с Cinder (multi-backend, QoS, шифрование), управление снапшотами и резервными копиями, восстановление ВМ, томов и баз данных; Автоматизация: использование Ansible/Terraform, CI/CD, написание Python/Bash-скриптов, интеграция с OpenStack API; Мониторинг и наблюдаемость (Observability): настройка метрик, логов, алертинга, дашбордов, корреляция metrics/logs/traces, проведение chaos-тестирования; Безопасность: управление Keystone/LDAP/AD, аудит, настройка TLS, шифрование, управление патчами и реагирование на CVE; Архитектура: обеспечение высокой доступности (HA), multi-region, отказоустойчивые сети и Ceph, выбор SDN/storage/hypervisor, планирование rollback и оптимизация инфраструктурных затрат; Документирование и взаимодействие: консультации, работа с вендорами, архитектурная документация, runbooks/post-mortem, менторинг команды. Наши пожелания к кандидатам: Опыт в системном администрировании, DevOps или SRE — от 5 до 7 лет и более; Эксплуатация OpenStack в промышленной среде (кластеры от 50+ физических узлов) — от 3 лет: развёртывание, миграция, обновление и масштабирование; Участие в on-call-дежурствах, разбор критических инцидентов (P0/P1), проведение root cause analysis и постмортемов; Опыт руководства и наставничества middle и junior-инженеров; Экспертное владение Linux: RHEL, Ubuntu, Debian, настройка ядра, работа с namespaces, cgroups, systemd, SELinux; Глубокое знание KVM/QEMU/libvirt: управление NUMA, CPU pinning, hugepages, SR-IOV, PCI passthrough, настройка производительности, работа с ядрами реального времени и низкой задержкой; SDN и OpenStack: работа с OVS, OVN, Tungsten Fabric/OpenDaylight, протоколы VXLAN, GRE, Geneve, VLAN, BGP, EVPN, DPDK; Глубокая диагностика сетей: OVSDB, flow tables, conntrack, iptables/nftables, eBPF; понимание Neutron (L2/L3, ML2, DHCP, Metadata); Глубокое понимание компонентов OpenStack: Nova, Neutron, Cinder, Glance, Keystone, Horizon, Swift, Placement; опыт работы с multi-region/multi-cell; Экспертное владение Ceph: архитектура, CRUSH, настройка производительности, управление OSD/MON/MDS, интеграция с Cinder/Glance, CephFS, RGW; Автоматизация с Ansible — сложные роли, модули, коллекции, dynamic inventory; Опыт работы с Terraform; Опыт работы с CI/CD (GitLab CI, Jenkins, GitHub Actions); Опыт работы с GitOps ; Python/Bash для автоматизации и интеграции с OpenStack API; Наблюдаемость (Observability): Prometheus, Grafana, VictoriaMetrics, ELK/EFK/Loki; распределённый трейсинг (Jaeger/Zipkin) — желательно; SRE-подходы: работа с SLI/SLO/SLA, error budgets, chaos engineering; разработка дашбордов, алертов и runbook'ов; Docker и Kubernetes: эксплуатация кластеров, CNI/CSI/operators; Опыт с Magnum или Kubernetes поверх OpenStack. Что мы предлагаем: Форма трудоустройства на ваш выбор: договору оказания услуг с ИП или самозанятым Участие в интересных масштабных проектах с Заказчиками федерального и международного уровня Работа с передовыми технологиями Возможности профессионального и карьерного роста Полностью удаленная работа Регулярная и достойная оплата труда В нашей команде работают профессионалы с разносторонним опытом. Здесь ты найдешь профессиональные задачи и новые вызовы, сможешь реализовать свой потенциал.Хочешь стать частью нашей команды? Мы ждем твоего отклика и свяжемся с тобой !