- Суть
- Изучение архитектуры Data Lakehouse на базе Iceberg, Trino, S3 и Kubernetes
- На выходе
- Проектировать, разворачивать и поддерживать системы класса Lakehouse; Управлять большими данными в формате Apache Iceberg поверх S3; Настраивать и эксплуатировать кластер Trino в среде Kubernetes; Создавать гибридные пайплайны данных на SQL, Python, Spark, DBT и Airflow; Реализовывать ACID-транзакции и управлять жизненным циклом данных
- Навыки
- Apache Iceberg · Trino · Kubernetes · Python · Apache Spark
- Кому подойдёт
- Аналитики данных; Инженеры данных; ML-инженеры