- Суть
- Проектирование распределенных систем обработки больших данных на базе Hadoop, Spark, Kafka и NoSQL
- На выходе
- Разрабатывать распределенные системы для обработки больших данных; Разворачивать и администрировать кластеры Hadoop; Анализировать структурированные и неструктурированные данные; Настраивать потоковую обработку данных в реальном времени; Выбирать оптимальные технологии хранения данных для IT-инфраструктуры
- Навыки
- Hadoop · Hortonworks/Ambari · Flink и Storm · Cassandra и MongoDB · Управление через YARN, Mesos, Zookeeper
- Кому подойдёт
- Специалисты с базовым опытом программирования и пониманием командной строки Linux
- Знать заранее
- Базовый опыт программирования (Python или Scala); Понимание командной строки Linux