Trino
PostgreSQL、データレイク、その他多くのデータソースにまたがる連合クエリを一箇所から実行できる、分散型 SQL クエリエンジンです。
概要
Trino は、PostgreSQL、オブジェクトストレージのデータレイク、Kafka など数十種類のコネクタを含む、さまざまな異なる基盤システムにまたがってデータを結合・集計する SQL クエリを、すべてのデータを1つのウェアハウスにコピーすることなく実行できます。クエリエンジンを、データが実際に存在する場所から切り離します。
Trino は、大規模なデータ移行プロジェクトを行うことなく、既存の複数のデータソースにまたがってクエリする必要があるチームに向いています。カタログにある ClickHouse のような、その場でクエリするのではなくデータ自体を保存する OLAP データベースとは異なる役割です。
- カテゴリ
- アナリティクス
- 言語
- Java
- ライセンス
- Apache-2.0
広告
関連プロジェクト
Beam
Apache-2.0複数の実行エンジンにまたがってポータブルに実行できる、バッチ・ストリームデータ処理パイプラインを定義するための統一プログラミングモデルです。
- アナリティクス
ClickHouse
Apache-2.0大量のデータセットに対するリアルタイムな分析クエリのために構築された列指向データベースで、集計レポートを秒単位や分単位ではなくミリ秒単位で生成します。
- アナリティクス
Druid
Apache-2.0継続的にストリーミングされる、および過去のイベントデータに対して、サブ秒単位のクエリを大規模に実行するために構築された、リアルタイム分析データベースです。
- アナリティクス
Flink
Apache-2.0継続的で無限のデータストリームに対して、Exactly-once の正確性保証のもとで計算を行う、分散型ストリーム処理エンジンです。
- アナリティクス
誤りを見つけましたか? GitHub で修正を提案する