Ir al contenido principal
usedby

2×

“SGLang achieved a 2× boost in throughput and markedly lower latency on one node.”

Tal como se publicó en nebius.com. Capturado por usedby el 7 oct 2026.

Qué pasó

SGLang, an open-source serving framework for large language models, ran and benchmarked DeepSeek R1 on Nebius AI Cloud infrastructure. It used on-demand compute clusters to test inference optimizations such as new attention algorithms, FP8 matrix multiplication and kernel fusion.

Resumen escrito por usedby a partir de la página de origen, en inglés. Las cifras son de Nebius AI Cloud y de SGLang, no nuestras.

SGLang achieved a 2× boost in throughput and markedly lower latency on one node. In practice, this means faster answers from R1, even on long prompts or with dozens of users at once.

De la página. nebius.com, capturada el 7 oct 2026

Lo que dice la historia, y lo que verificamos

Comparamos la historia con su página en línea el 7 oct 2026.

  • La cifra: 2×VerificadoImpresa palabra por palabra en la página, cerca del nombre de SGLang.
  • El pasaje citado arribaVerificadoCopiado palabra por palabra de la página, cerca del nombre de SGLang.
  • Los números de nuestro resumenVerificadoCada uno está impreso en la página.
  • SGLang usa Nebius AI CloudVerificadoLínea de nivel Confirmado. Última verificación entre todas las fuentes: 7 oct 2026.
  • El resultado en síNo verificadoLo citamos; no lo medimos.

Misma empresa, misma herramienta o mismo sector.

23%“a 23% improvement in total cost of ownership (TCO) compared to the previous cloud deployment”Antioch usa Nebius AI Cloud. Otro cliente de Nebius AI Cloud7,000 hourscompute hours to train Converge-SCConverge usa Nebius AI Cloud. Otro cliente de Nebius AI Cloud10 days“expedited the 500-million-parameter model base pre-training in just 10 days”Helical usa Nebius AI Cloud. Otro cliente de Nebius AI Cloud