Максим Алексеев
вопрос к концу доклада - Spark сейчас это, как я понимаю, только движок для Compute. а как в 21/22 годах выглядит дизайн полного data warehouse с использованием спарка? из предположения что проектируем с нуля- нужен ли отдельный шедулер джобов (Airflow etc)- какой backing storage нынче модно брать для большого масштаба? HDFS, колоночные базы, что-то еще- чем все это мониторить- любые другие важные компоненты DWH