Суть
Создание пайплайнов данных: сбор, очистка и подготовка данных с использованием Hadoop, Apache Spark и Airflow
На выходе
Разворачивать и настраивать Linux для задач инженерии данных; Проектировать пайплайны обработки данных в реальном времени; Использовать Apache Spark для трансформации больших объемов данных; Автоматизировать потоки данных с помощью Apache Airflow; Работать с облачными хранилищами AWS, Google Cloud и Azure
Навыки
Linux · Hadoop · Apache Spark · Apache Airflow · Google Cloud · Azure · Python
Знать заранее
базовое владение Python
Курс уже доступен

Как получить курс

Ждать завершения складчины не нужно — материалы готовы к выдаче.

  1. 1
    Оплатите доступ

    Добавьте курс в корзину и оплатите заказ удобным способом.

  2. 2
    Получите материалы

    После подтверждения оплаты ссылки придут на почту и появятся в разделе «Мои заказы».

  3. 3
    Скачайте и сохраните

    Все материалы курса можно скачать на своё устройство.