MLSP: Машинное обучение в Apache Spark / Сourse / Online / 16 May 2024

Сourse

2-дневный практический курс для разработчиков Apache Spark, дата инженеров и аналитиков данных, Data Scientist’ов и других специалистов Big Data, которые используют или планируют использовать Spark для решения задач машинного обучения и подготовки для него данных.

Аудитория

Практический курс по Спарк рассчитан на разработчиков Big Data, дата инженеров и аналитиков данных, Data Scientist’ов и других специалистов по большим данным, которые хотят получить опыт настройки и использования Apache Spark MLLib. На этом курсе мы изучаем предоставляемые спарк возможности в части подготовки данных (векторы в том числе разреженные, работа с пропущенными данными, нормализация, категориальные данные и т.п.) и машинного обучения (стандартные алгоритмы — регрессии, классификации, нейронные сети и т.п. — и конвейерная обработка). Курс будет интересен не только дата сайентистам, но и инженерам данных — на курсе мы покажем, что делают дата сайентисты (на примере Apache Spark).

Соотношение теории к практике 50/50

Предварительная подготовка

Опыт работы в Unix/SQL;
Знания в объеме, аналогичном курсу Core Spark
Начальный опыт программирования (Python/Java);
Начальный опыт в экосистеме Hadoop

Official web-site

https://bigdataschool.ru/courses/apache-spark-machine-learning

MLSP: Машинное обучение в Apache Spark

Аудитория

Log into