2×
“SGLang achieved a 2× boost in throughput and markedly lower latency on one node.”
Tal como se publicó en nebius.com. Capturado por usedby el 7 oct 2026.
Qué pasó
SGLang, an open-source serving framework for large language models, ran and benchmarked DeepSeek R1 on Nebius AI Cloud infrastructure. It used on-demand compute clusters to test inference optimizations such as new attention algorithms, FP8 matrix multiplication and kernel fusion.
Resumen escrito por usedby a partir de la página de origen, en inglés. Las cifras son de Nebius AI Cloud y de SGLang, no nuestras.
SGLang achieved a 2× boost in throughput and markedly lower latency on one node. In practice, this means faster answers from R1, even on long prompts or with dozens of users at once.
Lo que dice la historia, y lo que verificamos
Comparamos la historia con su página en línea el 7 oct 2026.
- La cifra: 2×VerificadoImpresa palabra por palabra en la página, cerca del nombre de SGLang.
- El pasaje citado arribaVerificadoCopiado palabra por palabra de la página, cerca del nombre de SGLang.
- Los números de nuestro resumenVerificadoCada uno está impreso en la página.
- SGLang usa Nebius AI CloudVerificadoLínea de nivel Confirmado. Última verificación entre todas las fuentes: 7 oct 2026.
- El resultado en síNo verificadoLo citamos; no lo medimos.




