DeepSpeed
Deep-Learning-Optimierungsbibliothek von Microsoft zum effizienten Trainieren und Ausführen sehr großer Modelle über mehrere GPUs hinweg.
Überblick
DeepSpeed implementiert speicher- und kommunikationseffiziente Techniken – wie ZeRO-Optimizer-State-Partitionierung –, die es Teams ermöglichen, Modelle zu trainieren, die weit größer sind, als sonst in verfügbaren GPU-Speicher passen würden, und beschleunigt das Training über mehrere GPUs und Maschinen hinweg. Es integriert sich mit PyTorch (ebenfalls in diesem Katalog), statt es zu ersetzen.
DeepSpeed eignet sich für Teams, die große Modelle trainieren, die an die Grenzen verfügbarer Hardware stoßen – eine spezialisierte Optimierungsschicht über PyTorch statt eines Allzweck-Frameworks; die meisten Teams greifen speziell dann darauf zurück, wenn standardmäßiges Single-GPU- oder naives Multi-GPU-Training nicht ausreicht.
- Kategorien
- KI & Machine Learning
- Sprachen
- Python
- Lizenz
- Apache-2.0
Ähnliche Projekte
PyTorch
BSD-3-ClauseQuelloffenes Machine-Learning-Framework, das den Weg vom Forschungsprototyp bis zum Produktions-Deployment beschleunigt.
- KI & Machine Learning
TensorFlow
Apache-2.0Durchgängige, quelloffene Plattform für maschinelles Lernen, von der Forschung bis zur Produktion.
- KI & Machine Learning
Unsloth
Apache-2.0Bibliothek zum deutlich schnelleren und speicherärmeren Feintunen großer Sprachmodelle im Vergleich zu Standard-Trainingsansätzen.
- KI & Machine Learning
CAMEL
Apache-2.0Open-Source-Framework für Forschung und den Bau von Systemen mehrerer kommunizierender, rollenspielender KI-Agenten, die autonom zusammenarbeiten.
- KI & Machine Learning
Einen Fehler entdeckt? Änderung auf GitHub vorschlagen.