Инженер по внедрению и эксплуатации ПО (Linux / Docker / Kubernetes)
Описание
Привет! Мы — команда L2U.Мы развиваем собственный продукт внутри Banks Soft Systems — одной из ведущих мировых компаний в сфере финансовых продуктов, сервисов и пользовательского опыта.С одной стороны, за нами стоит большая и серьёзная компания с устойчивым бизнесом и амбициозными проектами. С другой — мы продуктовая команда, которая экспериментирует, спорит о технологиях и искренне хочет делать продукт, которым не стыдно похвастаться даже маме 🙂 О роли Мы ищем инженера, который будет отвечать за установку, настройку, обновление и техническое сопровождение нашего продукта в инфраструктуре заказчиков. Это не классический пользовательский саппорт и не работа исключительно с готовой инфраструктурой. Инженер проходит путь от подготовки установки до эксплуатации продукта: помогает спроектировать вариант размещения, рассчитывает необходимые ресурсы, разворачивает систему, настраивает интеграции и мониторинг, а затем самостоятельно разбирается с возникающими техническими проблемами. Основные варианты развертывания — Docker Compose и Kubernetes (Helm). У части заказчиков встречаются legacy-инсталляции на виртуальных машинах. В работе много самостоятельного troubleshooting: если у клиента приложение недоступно, работает медленно или после обновления что-то пошло не так, нужно не просто передать проблему дальше, а разобраться, где находится причина, восстановить работоспособность и по возможности предотвратить повторение проблемы. Чем предстоит заниматься Подготовка и внедрение: участвовать в подготовке инсталляции продукта у заказчика; рассчитывать sizing исходя из предполагаемой нагрузки и сценариев использования; учитывать особенности инфраструктуры заказчика; консультировать технических специалистов заказчика по требованиям и варианту развертывания; разворачивать продукт в Docker Compose или Kubernetes; работать с нестандартными вариантами инфраструктуры: отказоустойчивые конфигурации, DBaaS, LBaaS и т.д. Настройка. После установки необходимо привести систему в рабочее состояние: настраивать конфигурацию приложения; подключать сертификаты; настраивать интеграции с почтой; настраивать LDAP/SSO; подключать внешние сервисы и кастомные интеграции; настраивать мониторинг; разворачивать и конфигурировать RAG-компонент с локальными или облачными моделями. Поддержка существующих инсталляций: расследовать инциденты на стендах заказчиков; анализировать логи, метрики и состояние сервисов; восстанавливать работоспособность системы; искать причины проблем с производительностью; устранять проблемы после обновлений; взаимодействовать с заказчиками и командой разработки; документировать найденные решения и причины инцидентов. Обновление и миграции: готовить и проводить обновления существующих инсталляций; работать с Docker Compose и Helm; участвовать в миграции legacy-инсталляций с виртуальных машин на контейнерную инфраструктуру; постепенно переходить от Bash-скриптов к автоматизации на базе Ansible. С чем предстоит работать Основной стек: Linux · Docker · Docker Compose · Kubernetes · Helm · Bash · PostgreSQL · Elasticsearch · Nginx · ClickHouse · Grafana · Prometheus Дополнительно: LDAP · SSO · сертификаты · HTTP/TCP/IP · Git · Ansible · RAG / LLM Что мы ждем Linux. Уверенно работать в Linux из консоли, уметь диагностировать состояние системы и приложения, читать логи, работать с процессами, файлами, правами и сетевыми настройками; Docker / Docker Compose. Уметь самостоятельно развернуть приложение через Docker Compose, разобраться в конфигурации контейнеров, посмотреть логи и состояние сервисов, перезапустить сервис, найти причину ошибки; Kubernetes. Не обязательно быть Kubernetes-администратором, но уметь деплоить приложение и сопровождать его: понимать pods/deployments/services, работать с Helm, смотреть состояние ресурсов и логи, выполнять базовый troubleshooting; Сети. Понимание HTTP, TCP/IP, DNS, reverse proxy/load balancer и умение локализовать сетевую проблему; Логи и мониторинг. Умение работать с логами и метриками, понимать, что смотреть при недоступности или деградации приложения; Базы данных. Понимание PostgreSQL на уровне эксплуатации: подключение, состояние, логи, базовые операции, backup/restore и понимание того, как БД влияет на работу приложения; Troubleshooting. Главное — способность самостоятельно разбираться с проблемой, а не сразу эскалировать ее. Будет плюсом опыт эксплуатации Elasticsearch / ClickHouse; опыт настройки отказоустойчивых конфигураций; Ansible; CI/CD; GitOps; Bash-автоматизация; Prometheus / Grafana / Loki; LDAP / SSO / Keycloak / OIDC; Kafka; опыт работы с Java-приложениями; опыт работы с RAG / LLM; опыт миграции VM → Docker; опыт работы непосредственно с enterprise-заказчиками. Что мы предлагаем работу над продуктом внутри крупной IT-компании — без корпоративной тяжеловесности; сильную команду, открытую коммуникацию и реальное участие в принятии решений; профессиональный рост без формальных карьерных матриц — через задачи, эксперименты и исследования; конкурентный доход с ростом и возможными премиями; мы — аккредитованная IT-компания; удалёнку, офис или гибрид — выбирай, как удобнее; помогаем с home office: техника, гарнитура или, может быть, тапочки! 🧦; заботу о себе: ДМС, английский, BestBenefits; живую культуру, ивенты, реферальную программу и нормальное человеческое общение.🧙♂️ Плюс в карму В сопроводительном письме будет здорово, если вы честно укажете свой уровень по ключевым для нас технологиям и приведёте короткие примеры из практики. Например: Linux — уверенный пользователь, самостоятельно диагностировал проблемы с сервисами и логами; Docker — разворачивал приложения через Compose; Kubernetes — работал с Helm и самостоятельно разбирал проблемы с pod'ами. Не нужно пытаться показать себя экспертом во всём — нам гораздо полезнее понимать, что вы действительно умеете делать самостоятельно, а где пока требуется помощь или есть зона для развития. Так мы сможем сразу предметно обсудить ваш опыт на собеседовании и не тратить время на общие вопросы.