2×
“SGLang achieved a 2× boost in throughput and markedly lower latency on one node.”
Tel que publié sur nebius.com. Capturé par usedby le 7 oct. 2026.
Ce qui s’est passé
SGLang, an open-source serving framework for large language models, ran and benchmarked DeepSeek R1 on Nebius AI Cloud infrastructure. It used on-demand compute clusters to test inference optimizations such as new attention algorithms, FP8 matrix multiplication and kernel fusion.
Résumé rédigé par usedby à partir de la page source, en anglais. Les chiffres sont ceux de Nebius AI Cloud et de SGLang, pas les nôtres.
SGLang achieved a 2× boost in throughput and markedly lower latency on one node. In practice, this means faster answers from R1, even on long prompts or with dozens of users at once.
Ce que dit le témoignage, et ce que nous avons vérifié
Nous avons comparé le témoignage à sa page en ligne le 7 oct. 2026.
- Le chiffre : 2×VérifiéImprimé mot pour mot sur la page, près du nom de SGLang.
- L’extrait cité plus hautVérifiéCopié mot pour mot depuis la page, près du nom de SGLang.
- Les nombres de notre résuméVérifiéChacun est imprimé sur la page.
- SGLang utilise Nebius AI CloudVérifiéLigne de niveau Confirmé. Dernière vérification, toutes sources confondues : 7 oct. 2026.
- Le résultat lui-mêmeNon vérifiéNous le citons ; nous ne l’avons pas mesuré.




