DeepSpeed
매우 큰 모델을 여러 GPU에 걸쳐 효율적으로 학습하고 실행하기 위한 Microsoft의 딥러닝 최적화 라이브러리입니다.
개요
DeepSpeed는 ZeRO 옵티마이저 상태 파티셔닝 같은 메모리·통신 효율화 기법을 구현하여, 사용 가능한 GPU 메모리에 원래는 들어가지 않을 만큼 큰 모델을 학습할 수 있게 해주고, 여러 GPU와 머신에 걸친 학습 속도를 높여줍니다. (카탈로그에 있는) PyTorch를 대체하는 것이 아니라 그것과 통합됩니다.
DeepSpeed는 사용 가능한 하드웨어의 한계를 밀어붙이는 대규모 모델을 학습하는 팀에 적합합니다. 범용 프레임워크가 아니라 PyTorch 위에 얹힌 특화된 최적화 계층으로, 대부분의 팀은 표준 단일 GPU나 단순한 멀티 GPU 학습으로는 부족할 때 특별히 이를 사용합니다.
- 카테고리
- AI 및 머신러닝
- 언어
- Python
- 라이선스
- Apache-2.0
광고
관련 프로젝트
PyTorch
BSD-3-Clause연구 프로토타이핑부터 프로덕션 배포까지의 과정을 가속화하는 오픈소스 머신러닝 프레임워크입니다.
- AI 및 머신러닝
TensorFlow
Apache-2.0연구부터 프로덕션까지 아우르는 엔드투엔드 오픈소스 머신러닝 플랫폼입니다.
- AI 및 머신러닝
Unsloth
Apache-2.0표준 학습 방식보다 훨씬 빠르고 메모리를 적게 사용하며 대규모 언어 모델을 파인튜닝하는 라이브러리입니다.
- AI 및 머신러닝
CAMEL
Apache-2.0자율적으로 협업하는, 여러 개의 소통하는 역할극 AI 에이전트 시스템을 연구하고 구축하기 위한 오픈소스 프레임워크입니다.
- AI 및 머신러닝
잘못된 정보를 발견하셨나요? GitHub에서 수정 제안하기