Мы продолжаем знакомить вас с современным SQL движком с отрытым кодом – Trino и проводим второй 2-х часовой практический мастер-класс.
Trino – это распределенный SQL движок, разработанный для работы с большими датасетами, распределенными между одним или несколькими неоднородными источниками данных.
На meetup мы на развернутом в яндекс-облаке кластере разберемся с тем, как Trino исполняет запросы. Кратко вспомним, как это делает другой движок – Apache Spark.
Во время митапа участники смогут самостоятельно поработать с Trino, подготовленная в юпитер ноутбуках среда сделает процесс работы с Trino максимально удобным.
Аудитория: аналитики, архитекторы платформ данных, инженеры данных, разработчики и просто интересующиеся современными технологиями обработки данных.
Продолжительность meetup: 2 академических часа, дистанционно. Trino кластер будет доступен участникам митапа 2 часа после окончания meetup.
Ссылка на страницу программы и регистрации https://shkola-bolshih-dannyh.timepad.ru/event/3308622/
Теги: big data trino apache spark spark online
Кратко о мероприятии
- Для кого
- аналитики данных, архитекторы платформ данных, инженеры данных, разработчики
- Основные темы
- Trino, Apache Spark, распределенный SQL-движок, обработка больших данных
- Что получите
- практический опыт работы с Trino, понимание того, как Trino выполняет запросы, сравнение с выполнением в Spark
- Формат программы
- практический, воркшоп, прикладной