Druid
지속적으로 유입되는 스트리밍 데이터와 과거 이벤트 데이터에 대해 대규모로 1초 미만의 쿼리를 수행하도록 만들어진 실시간 분석 데이터베이스입니다.
개요
Apache Druid는 (Kafka 같은) 스트리밍 소스와 배치 소스 모두로부터 지속적으로 데이터를 수집하며, 새 이벤트가 계속 들어오는 중에도 카운트, 합계, 백분위수 같은 빠른 집계 쿼리를 수행하도록 특별히 설계되었습니다. 실시간 대시보드와 사용자 대상 분석 기능을 지원하는 데 흔히 사용됩니다.
Druid는 지속적으로 유입되는 데이터를 기반으로 실시간 분석 대시보드나 사용자 대상 지표를 구축하는 팀에 적합하며, (카탈로그에 있는) ClickHouse를 보완합니다 — 둘 다 OLAP 엔진이지만 Druid의 아키텍처는 실시간 스트리밍 수집을 중심으로 특별히 최적화되어 있습니다.
- 카테고리
- 분석
- 언어
- Java
- 라이선스
- Apache-2.0
광고
관련 프로젝트
ClickHouse
Apache-2.0대규모 데이터셋에 대한 실시간 분석 쿼리를 위해 만들어진 컬럼형 데이터베이스로, 집계 리포트를 초 단위나 분 단위가 아니라 밀리초 단위로 생성합니다.
- 분석
Flink
Apache-2.0지속적이고 무한한 데이터 스트림에 대해 정확히 한 번(exactly-once) 처리를 보장하며 연산하는 분산 스트림 처리 엔진입니다.
- 분석
Beam
Apache-2.0여러 실행 엔진에 걸쳐 이식 가능하게 실행할 수 있는 배치·스트림 데이터 처리 파이프라인을 정의하기 위한 통합 프로그래밍 모델입니다.
- 분석
Matomo
GPL-3.0방문자 데이터에 대한 완전한 통제권과 소유권을 제공하는 오픈소스 웹 분석 플랫폼입니다.
- 분석
잘못된 정보를 발견하셨나요? GitHub에서 수정 제안하기