Aller au contenu principal
usedby

2×

“SGLang achieved a 2× boost in throughput and markedly lower latency on one node.”

Tel que publié sur nebius.com. Capturé par usedby le 7 oct. 2026.

Ce qui s’est passé

SGLang, an open-source serving framework for large language models, ran and benchmarked DeepSeek R1 on Nebius AI Cloud infrastructure. It used on-demand compute clusters to test inference optimizations such as new attention algorithms, FP8 matrix multiplication and kernel fusion.

Résumé rédigé par usedby à partir de la page source, en anglais. Les chiffres sont ceux de Nebius AI Cloud et de SGLang, pas les nôtres.

SGLang achieved a 2× boost in throughput and markedly lower latency on one node. In practice, this means faster answers from R1, even on long prompts or with dozens of users at once.

Extrait de la page. nebius.com, capturée le 7 oct. 2026

Ce que dit le témoignage, et ce que nous avons vérifié

Nous avons comparé le témoignage à sa page en ligne le 7 oct. 2026.

  • Le chiffre : 2×VérifiéImprimé mot pour mot sur la page, près du nom de SGLang.
  • L’extrait cité plus hautVérifiéCopié mot pour mot depuis la page, près du nom de SGLang.
  • Les nombres de notre résuméVérifiéChacun est imprimé sur la page.
  • SGLang utilise Nebius AI CloudVérifiéLigne de niveau Confirmé. Dernière vérification, toutes sources confondues : 7 oct. 2026.
  • Le résultat lui-mêmeNon vérifiéNous le citons ; nous ne l’avons pas mesuré.

Même entreprise, même outil ou même secteur.

23%“a 23% improvement in total cost of ownership (TCO) compared to the previous cloud deployment”Antioch utilise Nebius AI Cloud. Un autre client de Nebius AI Cloud7,000 hourscompute hours to train Converge-SCConverge utilise Nebius AI Cloud. Un autre client de Nebius AI Cloud10 days“expedited the 500-million-parameter model base pre-training in just 10 days”Helical utilise Nebius AI Cloud. Un autre client de Nebius AI Cloud