FAQ по Arenadata DB (ADB)
Как осуществляется шардирование данных по серверам?
Распределение таблиц по серверам возможно несколькими способами:
- случайное распределение,
- по ключу (одному полю или группе полей),
- репликация на все сегменты (актуально для справочников).
Использование одинакового ключа распределения для таблиц ускоряет соединения по этим полям.
Поддерживает ли ADB колоночное хранение данных?
Да, ADB поддерживает как строковый, так и колоночный формат хранения данных. Колоночное хранение оптимально для аналитической нагрузки. Также доступны полиморфные таблицы, позволяющие хранить данные в гибридном формате (партиции могут быть как строковыми, так и колоночными).
Насколько синтаксис и протокол ADB совместимы с PostgreSQL?
Совместимость составляет около 95%. Любое ПО, работающее с PostgreSQL, может взаимодействовать с ADB. Поддерживаются стандартные драйверы PostgreSQL (JDBC, ODBC).
Поддерживаются ли транзакции в ADB?
Да, ADB является ACID-совместимой системой. Поддерживаются два уровня изоляции транзакций:
- Read Committed (используется по умолчанию),
- Repeatable Read.
Уровень Serializable можно установить, но он фактически работает как Repeatable Read.
Как эффективно загружать данные в ADB?
- Для небольших объемов данных можно использовать стандартный PostgreSQL-интерфейс (например, JDBC или ODBC).
- Для загрузки больших объемов рекомендуется применять GPFDIST (параллельная загрузка) или расширение Platform Extension Framework (PXF).
Ключевые функциональные возможности Arenadata DB
- ACID-транзакционность.
- Поддержка строкового и колоночного хранения данных.
- Механизмы резервного копирования и восстановления с параллельным выполнением на всех узлах кластера.
- Гибкая система партиционирования с возможностью выбора ориентации хранения (строковая/колоночная) и различных параметров компрессии для партиций.
- Параллельная запись данных в сегменты кластера.
- Управление ресурсами: механизм квотирования CPU и RAM, управление очередями выполнения.
- Поддержка стандарта ANSI SQL 2008+.
- Эффективные алгоритмы сжатия данных (например, Z_Standard), возможность выбора типа и уровня компрессии.
- Встроенные инструменты анализа данных, включая построение линейной регрессии и нейронных сетей.
Какой тип масштабирования поддерживает ADB и за счет чего?
ADB использует массивно-параллельную архитектуру (Shared Nothing MPP), обеспечивающую:
- наличие нескольких сегмент-серверов,
- шардирование данных с учетом локальности выполнения запросов.
Какие интеграционные возможности предоставляет Arenadata DB?
- Единая точка входа для SQL-запросов к разным системам хранения данных.
- Инструменты для создания федерации данных без увеличения времени доступа.
- Возможность подключения любых источников данных, поддерживающих ODBC/JDBC.
- Поддержка коннекторов к популярному ПО, включая ClickHouse, Spark, Kafka, Greenplum.



