Event cover Trino Meetup #2: Trino в Тинькофф, и как ускорить чтение из Data Lake с помощью кэширования
Data Science and Big Data

Trino Meetup #2: Trino в Тинькофф, и как ускорить чтение из Data Lake с помощью кэширования

Обсудим, как Тинькофф использует Trino в своей аналитической платформе, и рассмотрим различные способы ускорения работы с озерами данных с помощью кэширования на примере решений Alluxio, Starburst Warp Speed (ex-Varada) и CedrusData. Митап организован компанией Querify Labs, разрабатывающей CedrusData — коммерческий форк Trino для российского рынка.

Программа:

  • 18:00–19:00 | Доклад "Trino в Тинькофф" — Дмитрий Зуев, Тинькофф
    Платформа данных Тинькофф содержит более пяти петабайт данных и ежемесячно обслуживает около пятнадцати тысяч пользователей. В своем докладе Дмитрий расскажет об архитектуре платформы и роли Trino в аналитическом стеке компании.
  • 19:00–20:00 | Доклад "Как ускорить работу Trino с Data Lake c помощью кэширования" — Владимир Озеров, CedrusData
    Trino работает с данными в удаленных источниках, что приводит к накладным расходам на сетевое взаимодействие и декодирование данных во внутренний формат Trino. В докладе мы обсудим различные способы ускорения запросов с помощью кэширования в проектах экосистемы Trino/Presto: Raptor(X), Alluxio, Starburst Warp Speed (ex-Varada) и CedrusData.

Event at a glance

Who it is for
инженеры данных, инженеры аналитических платформ, пользователи Trino
Main topics
Trino, data lake, кэширование, аналитическая платформа
What you will gain
понять архитектуру Trino в Тинькофф, изучить стратегии кэширования для Trino, сравнить решения для кэширования
Program format
производственные кейсы, глубокие технические доклады