DeepSpeed
非常に大規模なモデルを複数の GPU にまたがって効率的にトレーニング・実行するための、Microsoft 発の深層学習最適化ライブラリです。
概要
DeepSpeed は、ZeRO オプティマイザー状態パーティショニングのような、メモリと通信の効率化技術を実装しており、利用可能な GPU メモリに本来収まらないほど大規模なモデルのトレーニングを可能にし、複数の GPU やマシンにまたがるトレーニングを高速化します。(カタログにもある) PyTorch を置き換えるのではなく、それと統合して動作します。
DeepSpeed は、利用可能なハードウェアの限界に挑む大規模モデルをトレーニングするチームに向いています。汎用フレームワークではなく、PyTorch の上に乗る特化した最適化レイヤーで、標準的な単一 GPU やナイーブなマルチ GPU トレーニングでは不十分な場合に、多くのチームが特にこれを選びます。
- カテゴリ
- AI・機械学習
- 言語
- Python
- ライセンス
- Apache-2.0
広告
関連プロジェクト
PyTorch
BSD-3-Clause研究段階のプロトタイピングから本番デプロイまでの道のりを加速する、オープンソースの機械学習フレームワークです。
- AI・機械学習
TensorFlow
Apache-2.0研究から本番運用まで対応する、エンドツーエンドのオープンソース機械学習プラットフォームです。
- AI・機械学習
Unsloth
Apache-2.0標準的なトレーニング手法よりも大幅に高速かつ少ないメモリで、大規模言語モデルをファインチューニングするためのライブラリです。
- AI・機械学習
CAMEL
Apache-2.0自律的に協調する、複数のコミュニケーションを行うロールプレイング AI エージェントのシステムを研究・構築するための、オープンソースフレームワークです。
- AI・機械学習
誤りを見つけましたか? GitHub で修正を提案する