Data Scientist, Базовые модели и инструменты
Описание
Привет! Это команда Базовые модели и инструменты.Наша команда создаёт ядро системы модерации контента. Мы разрабатываем и оптимизируем высоконагруженные модели компьютерного зрения и обработки речи/текста (OCR, ASR, TTS), которые становятся «глазами и ушами» всей платформы. Результаты нашей работы напрямую влияют на скорость, точность и стоимость модерации миллионов единиц контента ежедневно. Параллельно мы строим внутренние ML-инструменты на базе LLM, автоматизированных пайплайнов и self-service интерфейсов. Они позволяют сократить количество рутинных задач у DS-специалистов и продуктовых команд.Ищем Data Scientist , который готов проектировать production-архитектуру сервисов под высокие нагрузки, адаптировать SOTA-модели к реальным ограничениям и влиять на техническую стратегию команды. Вы будете Проектировать, обучать и выводить в production модели NLP/CV. Участвовать в перестройке архитектуры модерации: выделять общие backbone, разрабатывать adapters под конкретные домены и задачи. Оптимизировать модели под high-load: квантизация, ONNX/TensorRT, batching, динамический routing, Разрабатывать внутренние ML-инструменты и пайплайны: автоматический запуск переобучения, валидация, мониторинг дрейфа, self-service для смежных команд. Проводить code review, выстраивать стандарты качества кода и документации. Нам важно Опыт работы с NLP/СV от 2 лет. Опыт создания решений для реалтайм оценки ML-моделей. Способность строить процессы, а не только запускать отдельные эксперименты. Умение соблюдать баланс между строгостью оценки и скоростью доставки решений в продакшен. Умение обосновывать решения на основе данных. Умение объяснять сложные метрики простым языком.