Trino
여러 데이터 소스——데이터베이스, 데이터 레이크 등——에 걸쳐 한 곳에서 연합 쿼리를 실행할 수 있게 해주는 분산 SQL 쿼리 엔진입니다.
개요
Trino는 PostgreSQL, 오브젝트 스토리지 데이터 레이크, Kafka를 비롯한 수십 개의 커넥터 등 다양한 기반 시스템에 걸쳐 데이터를 조인하고 집계하는 SQL 쿼리를, 모든 데이터를 하나의 웨어하우스로 먼저 복사하지 않고도 실행할 수 있게 해줍니다. 쿼리 엔진을 데이터가 실제로 있는 위치와 분리합니다.
Trino는 대규모 데이터 마이그레이션 프로젝트 없이 여러 기존 데이터 소스에 걸쳐 쿼리해야 하는 팀에 적합하며, 카탈로그에 있는 ClickHouse 같은, 데이터를 제자리에서 쿼리하기보다 직접 저장하는 OLAP 데이터베이스와는 다른 역할을 합니다.
- 카테고리
- 분석
- 언어
- Java
- 라이선스
- Apache-2.0
광고
관련 프로젝트
Beam
Apache-2.0여러 실행 엔진에 걸쳐 이식 가능하게 실행할 수 있는 배치·스트림 데이터 처리 파이프라인을 정의하기 위한 통합 프로그래밍 모델입니다.
- 분석
ClickHouse
Apache-2.0대규모 데이터셋에 대한 실시간 분석 쿼리를 위해 만들어진 컬럼형 데이터베이스로, 집계 리포트를 초 단위나 분 단위가 아니라 밀리초 단위로 생성합니다.
- 분석
Druid
Apache-2.0지속적으로 유입되는 스트리밍 데이터와 과거 이벤트 데이터에 대해 대규모로 1초 미만의 쿼리를 수행하도록 만들어진 실시간 분석 데이터베이스입니다.
- 분석
Flink
Apache-2.0지속적이고 무한한 데이터 스트림에 대해 정확히 한 번(exactly-once) 처리를 보장하며 연산하는 분산 스트림 처리 엔진입니다.
- 분석
잘못된 정보를 발견하셨나요? GitHub에서 수정 제안하기