Druid
継続的にストリーミングされる、および過去のイベントデータに対して、サブ秒単位のクエリを大規模に実行するために構築された、リアルタイム分析データベースです。
概要
Apache Druid は、(Kafka のような) ストリーミングソースとバッチソースの両方から継続的にデータを取り込み、新しいイベントが到着し続けている状況でも、カウント・合計・パーセンタイルといった高速な集計クエリを実行できるよう特化して設計されています。リアルタイムダッシュボードやユーザー向け分析機能を支えるためによく使われます。
Druid は、継続的にストリーミングされるデータに基づいてリアルタイム分析ダッシュボードやユーザー向けメトリクスを構築するチームに向いています。(カタログにもある) ClickHouse を補完する存在で、両者とも OLAP エンジンですが、Druid のアーキテクチャは特にリアルタイムのストリーミング取り込みに最適化されています。
- カテゴリ
- アナリティクス
- 言語
- Java
- ライセンス
- Apache-2.0
広告
関連プロジェクト
ClickHouse
Apache-2.0大量のデータセットに対するリアルタイムな分析クエリのために構築された列指向データベースで、集計レポートを秒単位や分単位ではなくミリ秒単位で生成します。
- アナリティクス
Flink
Apache-2.0継続的で無限のデータストリームに対して、Exactly-once の正確性保証のもとで計算を行う、分散型ストリーム処理エンジンです。
- アナリティクス
Beam
Apache-2.0複数の実行エンジンにまたがってポータブルに実行できる、バッチ・ストリームデータ処理パイプラインを定義するための統一プログラミングモデルです。
- アナリティクス
Matomo
GPL-3.0訪問者データの完全な管理と所有権をもたらす、オープンソースのウェブ解析プラットフォームです。
- アナリティクス
誤りを見つけましたか? GitHub で修正を提案する