Случаи использования Trino
В этом разделе Trino рассматривается в перспективе, чтобы будущие администраторы и конечные пользователи знали, чего можно ожидать от Trino.
Чем Trino не является
Поскольку многие члены сообщества называют Trino базой данных, имеет смысл начать с определения того, чем Trino не является.
Не стоит путать тот факт, что Trino понимает SQL, с тем, что он предоставляет все возможности стандартной базы данных. Trino не является реляционной базой данных общего назначения, и, соответственно, не является заменой таких баз данных, как MySQL, PostgreSQL или Oracle.
Trino не была разработана для обработки транзакций в режиме онлайн (OLTP). Это справедливо и для многих других баз данных, разработанных и оптимизированных для хранения данных или аналитики.
Что такое Trino
Trino - это инструмент, предназначенный для эффективной обработки огромных объемов данных с помощью распределенных запросов. Если Вы работаете с терабайтами или петабайтами данных, то, скорее всего, используете инструменты, которые взаимодействуют с Hadoop и HDFS. Trino был разработан как альтернатива инструментам, запрашивающим HDFS с помощью конвейеров заданий MapReduce, таким как Hive или Pig. Однако Trino не ограничивается доступом к HDFS, он расширен для работы с различными типами источников данных, включая традиционные реляционные базы данных и другие источники данных, такие как Cassandra.
Trino был разработан для работы с хранилищами данных и аналитикой: анализ данных, агрегирование больших объемов данных и создание отчетов. Эти рабочие нагрузки часто классифицируются как Online Analytical Processing (OLAP).




