본문으로 건너뛰기
FindOpenSource

Beam

여러 실행 엔진에 걸쳐 이식 가능하게 실행할 수 있는 배치·스트림 데이터 처리 파이프라인을 정의하기 위한 통합 프로그래밍 모델입니다.

개요

Apache Beam은 통합된 배치/스트림 API를 사용해 데이터 파이프라인을 한 번만 작성하면, (카탈로그에 있는) Flink와 Spark를 포함한 서로 다른 기반 실행 엔진에서 엔진마다 다시 작성하지 않고도 동일한 파이프라인을 실행할 수 있게 해줍니다. 이를 통해 파이프라인 로직이 특정 처리 엔진에 종속되는 것을 피할 수 있습니다.

Beam은 실행 엔진 간 파이프라인 이식성을 원하는 팀이나, (Beam을 프로그래밍 모델로 사용하는) Google Cloud Dataflow 위에 구축하는 팀에 적합합니다. Flink나 Spark 자체와는 다른 계층으로, 그것들은 Beam 파이프라인이 실제로 실행되는 엔진입니다.

카테고리
분석
키워드
data-pipelinebatch-processingstream-processingportable-pipelines
언어
Java, Python, Go
라이선스
Apache-2.0

잘못된 정보를 발견하셨나요? GitHub에서 수정 제안하기