Saltar al contenido
FindOpenSource

SGLang

Framework de servicio rápido para grandes modelos de lenguaje y modelos de visión-lenguaje, con un lenguaje de generación estructurada para programas LLM complejos.

Descripción general

SGLang combina un backend de inferencia de alto rendimiento con un lenguaje frontend para expresar interacciones LLM complejas —razonamiento en varios pasos, salida estructurada, llamadas a herramientas— como un único programa que el runtime puede optimizar en su conjunto, en lugar de como una serie de llamadas API independientes. Apunta tanto al throughput de servicio puro como a la expresividad para cargas de trabajo complejas de tipo agente.

SGLang encaja en equipos que necesitan servicio de LLM de alto rendimiento combinado con patrones de generación estructurada y multietapa, una alternativa centrada en el rendimiento a vLLM (también en este catálogo) que los equipos suelen comparar entre sí.

Categorías
IA y Machine Learning
Palabras clave
llm-inferencemodel-servingstructured-generation
Lenguajes
Python
Licencia
Apache-2.0

¿Encontraste un error? Sugiere una edición en GitHub.