Beam
Einheitliches Programmiermodell zum Definieren von Batch- und Stream-Datenverarbeitungspipelines, die portabel über mehrere Ausführungs-Engines hinweg laufen können.
Überblick
Apache Beam lässt ein Team eine Datenpipeline einmal mit seiner einheitlichen Batch/Stream-API schreiben und dieselbe Pipeline dann auf verschiedenen zugrunde liegenden Ausführungs-Engines laufen lassen – einschließlich Flink und Spark (ebenfalls in diesem Katalog) –, ohne sie für jede neu zu schreiben. Das verhindert, dass die Logik einer Pipeline an eine bestimmte Verarbeitungs-Engine gebunden wird.
Beam eignet sich für Teams, die Pipeline-Portabilität über Ausführungs-Engines hinweg wollen, oder die auf Google Cloud Dataflow aufbauen (das Beam als Programmiermodell nutzt) – eine andere Schicht als Flink oder Spark selbst, die die Engines sind, auf denen Beam-Pipelines tatsächlich laufen.
- Kategorien
- Analytics
- Sprachen
- Java, Python, Go
- Lizenz
- Apache-2.0
Ähnliche Projekte
Spark
Apache-2.0Einheitliche Analytics-Engine für Batch- und Stream-Datenverarbeitung im großen Maßstab, eines der am weitesten verbreiteten Big-Data-Frameworks.
- Analytics
Flink
Apache-2.0Verteilte Stream-Processing-Engine zur Berechnung über kontinuierliche, unbegrenzte Datenströme mit Exactly-once-Korrektheitsgarantien.
- Analytics
ClickHouse
Apache-2.0Spaltenorientierte Datenbank für Echtzeit-Analyseabfragen über riesige Datensätze, die aggregierte Berichte in Millisekunden statt Sekunden oder Minuten erzeugt.
- Analytics
Druid
Apache-2.0Echtzeit-Analytics-Datenbank für Abfragen unter einer Sekunde über kontinuierlich streamende und historische Ereignisdaten im großen Maßstab.
- Analytics
Einen Fehler entdeckt? Änderung auf GitHub vorschlagen.