跳至内容
FindOpenSource

Beam

统一的编程模型,用于定义批处理和流处理数据管道,可在多种执行引擎间以可移植的方式运行。

概述

Apache Beam 让团队使用其统一的批/流 API 只编写一次数据管道,然后就能在不同的底层执行引擎上运行同一套管道——包括目录中的 Flink 和 Spark——而无需为每种引擎重写。这避免了将管道逻辑锁定在某一特定处理引擎上。

Beam 适合那些希望管道能够跨执行引擎移植的团队,或者正在基于 Google Cloud Dataflow(其以 Beam 为编程模型)构建的团队;它与 Flink 或 Spark 本身属于不同的层级——后两者是 Beam 管道实际运行的引擎。

分类
分析
关键词
data-pipelinebatch-processingstream-processingportable-pipelines
编程语言
Java, Python, Go
许可证
Apache-2.0

发现信息有误?在 GitHub 上提出修改建议