Aller au contenu principal
usedby

78%

“78% lower latency, from over 700 milliseconds to 160 milliseconds end-to-end”

Tel que publié sur baseten.co, septembre 2025. Capturé par usedby le 5 oct. 2026.

Ce qui s’est passé

OpenEvidence, a medical technology company, runs the inference for its AI-powered medical search platform on Baseten, including embeddings inference, multi-cloud compute capacity, and model training. This lets clinicians get medical information at the point of care without the team managing its own inference infrastructure.

Résumé rédigé par usedby à partir de la page source, en anglais. Les chiffres sont ceux de Baseten et de OpenEvidence, pas les nôtres.

  • 6x“6x faster deployment processes, from multiple engineers spending hours on a deployment to one engineer spending less than an hour”
  • 8x+“8x+ reduction in infrastructure maintenance time overall”
  • 3x“With Baseten Embeddings Inference, we immediately saw 3x speed improvements.”

By using Baseten, OpenEvidence achieved: 78% lower latency, from over 700 milliseconds to 160 milliseconds end-to-end

Extrait de la page. baseten.co, capturée le 5 oct. 2026

Our team spent weeks researching and vetting inference providers. It was a thorough process and we confidently believe Baseten is a clear winner.

Eric Lehman, Head of Clinical NLP, OpenEvidence. Source, capturée le 5 oct. 2026

Ce que dit le témoignage, et ce que nous avons vérifié

Nous avons comparé le témoignage à sa page en ligne le 5 oct. 2026.

  • Le chiffre : 78%VérifiéImprimé mot pour mot sur la page, près du nom de OpenEvidence.
  • L’extrait cité plus hautVérifiéCopié mot pour mot depuis la page, près du nom de OpenEvidence.
  • La date de publicationVérifiéLue dans les métadonnées de la page, jamais devinée.
  • OpenEvidence utilise BasetenVérifiéLigne de niveau Confirmé. Dernière vérification, toutes sources confondues : 5 oct. 2026.
  • Le résultat lui-mêmeNon vérifiéNous le citons ; nous ne l’avons pas mesuré.

Même entreprise, même outil ou même secteur.

< 10msSearch latency with high recallOpenEvidence utilise Zilliz. Un autre outil chez OpenEvidence3x“3x cost savings when moving from closed-source to open-source models”Parallel Web Systems utilise Baseten. Un autre client de Baseten60%“~60% reduction in inference costs”EliseAI utilise Baseten. Un autre client de Baseten