Zum Inhalt springen
FindOpenSource

Alluxio

Datenorchestrierungsschicht zwischen Compute-Engines und Speichersystemen, die Daten für schnelleren, einheitlichen Zugriff zwischen beiden cached.

Überblick

Alluxio sitzt zwischen Compute-Frameworks (wie Spark oder Trino) und einem oder mehreren zugrunde liegenden Speichersystemen (S3, HDFS und andere), stellt einen einheitlichen Namensraum bereit und cached häufig genutzte Daten im Speicher oder auf schnellen lokalen Festplatten, um Analytics-Workloads zu beschleunigen, ohne die zugrunde liegenden Daten zu verschieben. Es entkoppelt Compute vom Speicherort.

Alluxio eignet sich für Datenplattform-Teams, die Analytics-Engines gegen entfernten oder langsamen Speicher betreiben und eine Caching- und Vereinheitlichungsschicht wollen – eine andere Rolle als die Objektspeichersysteme (MinIO, SeaweedFS), die bereits in diesem Katalog sind: Es sitzt vor dem Speicher, statt selbst Speicher zu sein.

Kategorien
Storage
Schlagwörter
data-orchestrationcaching-layerbig-dataunified-namespace
Sprachen
Java
Lizenz
Apache-2.0

Einen Fehler entdeckt? Änderung auf GitHub vorschlagen.