Освоение архитектуры HDFS, настройки вычислений MapReduce и обработки массивов данных с помощью Hive
На выходе
Работать с распределенными файловыми системами HDFS; Настраивать и оптимизировать Hadoop-задачи; Проводить аналитику данных с помощью Hive; Выполнять сериализацию и десериализацию данных; Настраивать партиционирование и бакетирование для масштабирования вычислений
Навыки
Работа с HDFS · Настройка MapReduce · Аналитика в Hive · Партиционирование · Бакетирование · Тюнинг Join · Сериализация и десериализация
Кому подойдёт
Разработчикам; Аналитикам; Инженерам данных; Data Scientists