- Суть
- Настройка Linux-среды и проектирование конвейеров данных с помощью Hadoop, Spark и Airflow.
- Уровень
- для практикующих
- На выходе
- Настраивать рабочую среду в Linux для задач инженерии данных; Проектировать и разворачивать data pipelines с помощью Apache Airflow; Работать с экосистемой Hadoop и файловой системой HDFS; Обрабатывать большие объемы данных с использованием Apache Spark; Интегрировать данные из различных источников с использованием SQL и JDBC
- Навыки
- Linux · Apache Airflow · Hadoop · HDFS · Apache Spark · JDBC
- Кому подойдёт
- Те, кто уже знаком с Python и хочет перейти к Data Engineering
- Знать заранее
- Знакомство с Python