Arenadata Picodata
Arenadata Picodata — это масштабируемая, отказоустойчивая распределённая база данных класса NewSQL, созданная для высоконагруженных транзакционных систем с жёсткими требованиями к доступности, консистентности и скорости обработки операций. Основана на российской разработке Picodata, официально адаптированной и поддерживаемой в составе Arenadata Platform.
Picodata построена на базе PostgreSQL-совместимого API, но работает на собственной архитектуре Shared-nothing и Raft-кластеризации, обеспечивая горизонтальное масштабирование, автоматическое восстановление узлов и real-time обработку записей.
Бизнес-ценность и сценарии применения
Для чего используется Arenadata Picodata
- Обработка транзакционных нагрузок в режиме 24/7
- Микросервисные и финансовые системы с миллионами операций в минуту
- Фронтовые базы данных для интернет-сервисов, цифровых каналов, мобильных приложений
- Импортозамещение коммерческих решений: CockroachDB, Yugabyte, Spanner
Ключевые задачи
- Быстрая запись и чтение в геораспределённых инсталляциях
- Поддержка ACID-транзакций на уровне SQL
- Online масштабирование без остановки
- Обработка OLTP-нагрузки без потери производительности
Примеры использования
- Реестровые и регистровые сервисы: госуслуги, банкинг, логистика
- Хранилище данных о сессиях, логинах, авторизациях
- Системы расчётов, ордер-менеджмент
- Событийные шины и источники данных для CDC-инфраструктуры
Технические особенности Picodata
Архитектура
- Shared-nothing кластер, каждый узел содержит собственную часть данных
- Встроенный Raft-консенсус для отказоустойчивости
- Полная совместимость с PostgreSQL wire protocol
- Automatic sharding по первичному ключу
- Поддержка multi-region replication
Основные компоненты
- Picodata Cluster: набор рабочих нод
- Control Plane: сервис управления и балансировки
- Storage Engine: Key-Value движок с транзакционной обвязкой
- SQL Proxy Layer: маршрутизация запросов с поддержкой psql
Установка и запуск
Требования к хостам:
- CPU: от 4 vCPU
- RAM: от 16 ГБ
- Диск: NVMe, 100K IOPS+
- Сеть: 1+ Гбит/с, стабильное соединение между регионами
Установка через ADCM:
- Импорт picodata-bundle.tar.gz
- Назначение ролей: coordinator, storage, sql-gateway
- Настройка параметров: replication, Raft timeout, shard count
- Действия:
adcm action run --cluster picodata --action install
Поддержка SQL и интеграция
Поддержка SQL:
- DML: INSERT, UPDATE, DELETE, SELECT
- ACID-транзакции: BEGIN, COMMIT, ROLLBACK
- Индексы: B-Tree, Hash
- Ограничения: PRIMARY KEY, UNIQUE
Совместимость с:
- psql
- JDBC, ODBC драйверы PostgreSQL
- BI-платформы: Arenadata Catalog, Power BI, Superset
- CDC-интеграции: Debezium, Kafka
Масштабирование и отказоустойчивость
Горизонтальное масштабирование
- Добавление новых shard’ов без даунтайма
- Перераспределение данных по узлам
Репликация и отказоустойчивость
- Используется Raft для избирательного согласования записей
- Каждая запись проходит через leader-шард с последующей репликацией
- Механизм quorum write (n/2 + 1)
- Быстрый failover и auto-heal при сбоях
Плюсы и минусы
Преимущества
- Масштабируемость без остановки системы
- Настоящая HA через Raft + автораспределение данных
- Совместимость с PostgreSQL-приложениями
- Российская разработка с открытым API
- Подходит под требования ФСТЭК и импортозамещения
Ограничения
- Молодая экосистема (по сравнению с PostgreSQL)
- Не все расширения PostgreSQL совместимы
- Высокие требования к IOPS и сетевой задержке
- Не поддерживает OLAP-нагрузки (ориентирован на OLTP)
Поддержка, документация и обновления
- Актуальные версии доступны через репозитории Arenadata
- Обновления: через ADCM → upgrade action
- Документация: https://docs.arenadata.io/picodata (при наличии)
- Git: публичный SDK и обёртки для интеграции
Заключение
Arenadata Picodata — это современная высоконагруженная распределённая СУБД для транзакционных систем, критичных к времени отклика, доступности и масштабируемости. Благодаря архитектуре без общей точки отказа, полной поддержке SQL и интеграции в платформу Arenadata, она является мощной альтернативой для всех, кто ищет производительное решение класса NewSQL в российском контуре ИБ.



