Стажер ML
Описание
Локация: удалённая работа; также доступны офисы с зонами коворкинга
Компания
IT-компания, разрабатывающая решения для разных отраслей и реализующая сотни проектов.
Что делать
Разрабатывать ML-решения для прогнозирования в ритейле и работы с временными рядами.
Обрабатывать, анализировать и агрегировать большие объёмы данных.
Создавать ETL-процессы для чтения, трансформации и записи данных.
Оптимизировать Spark-запросы с использованием партиционирования, кэширования и broadcast-переменных.
Применять ML-модели к большим данным в PySpark.
Требования
Опыт в Data Science или Machine Learning от 2 лет.
Глубокое знание Python, SQL и PySpark.
Навыки разработки ETL-процессов и работы с большими данными.
Знание Scikit-learn и TensorFlow или PyTorch.
Опыт обработки данных, анализа и feature engineering.
Прагматичный подход к выбору реализуемых ML-решений.
Хорошо, если есть
Опыт production-разработки, а не только исследовательской работы.
Умение запускать ML-модели в PySpark и использовать Spark MLlib для распределённого обучения.
Опыт работы с PySpark Pandas UDFs.
Понимание бизнес-процессов за пределами Jupyter Notebook.
Культура и преимущества
Работа в команде экспертов и развитая система наставничества.
Гибкий график и выстроенные процессы удалённой работы.
Возможность осваивать новые технологии и развиваться в направлениях тимлида, архитектора или full-stack-разработчика.
Сертификация за счёт компании, участие в конференциях и изучение английского языка.
Митапы, хакатоны, обмен опытом и более 50 профессиональных сообществ и клубов по интересам.