Старший Data Scientist, Команда модерации селлерского контента
Описание
Привет! Это команда "Модерация селлерского контента" Наша команда отвечает за автоматическую модерацию селлерского контента, обеспечивая его соответствие законодательству РФ и правилам маркетплейса. Много работаем с изображениями и текстами, используем современные подходы из NLP, CV и Multi-modal ML, а также активно внедряем их в production. Сейчас мы ищем Senior Data Scientist, который усилит нас в задачах компьютерного зрения и обработки естественного языка. Вы будете Участвовать в составлении роадмапа разработки, проводить ресерч и формулировать гипотезы для решения задач; Заниматься полным циклом разработки моделей автомодерации контента; Работать с multi-modal данными: изображениями, текстами и таблицами; Разрабатывать эффективный и воспроизводимый код для обучения моделей; Оптимизировать модели, ускорять inference и улучшать бизнес-метрики; Делиться опытом с другими участниками команды, участвовать в код-ревью; Взаимодействовать с аналитиками, продактами и разработчиками сервисов. Нам важно Уверенное знание Python и опыт разработки на нём; Понимание алгоритмов и структур данных на уровне задач LeetCode Medium и выше; Практический опыт работы с PyTorch; Знание математической статистики, линейной алгебры и теории вероятностей; Отличные знания в области машинного обучения: классический ML и DL, способность объяснить принципы работы алгоритмов и выбрать подходящий для задачи; Практический опыт работы в задачах NLP и/или CV, знание современных архитектур (Transformers, CLIP и др.); Понимание принципов работы с большими данными, знакомство с такими инструментами как Hadoop, Spark, Airflow, SQL; Опыт ведения проектов: принятие технических решений, декомпозиция и распределение задач, координации разработки. Будет плюсом Опыт работы с NVIDIA Triton Inference Server; Навыки оптимизации и ускорения нейросетей (ONNX, TensorRT, quantization и т.д.).