Aller au contenu principal
usedby

30%

“30% lower cost per call”

Tel que publié sur baseten.co, août 2026. Vérifié par usedby le 9 oct. 2026.

Ce qui s’est passé

You.com runs open-source LLMs on Baseten's dedicated, multi-region deployments to handle the synthesis step of its Answer API, turning retrieved passages into cited, verified answers instead of routing each query to a frontier model.

Résumé rédigé par usedby à partir de la page source, en anglais. Les chiffres sont ceux de Baseten et de you.com, pas les nôtres.

  • 93.48%“93.48% accuracy on SimpleQA, 2.67-second p50 latency, and $5 per 1,000 calls.”

Compared with routing synthesis to a frontier model, You.com saw:

Extrait de la page. baseten.co

We think open-weight models plus web search is a powerful alternative to routing everything through frontier model providers, at a fraction of the price and comparable quality for our developers.

Saahil Jain, CTO, You.com. Source

Ce que dit le témoignage, et ce que nous avons vérifié

Ce que nous avons comparé à la page.

  • Le chiffre : 30%VérifiéImprimé mot pour mot sur la page, près du nom de you.com.
  • L’extrait cité plus hautVérifiéCopié mot pour mot depuis la page, près du nom de you.com.
  • La date de publicationVérifiéLue dans les métadonnées de la page, jamais devinée.
  • you.com utilise BasetenVérifiéLigne de niveau Confirmé.
  • Le résultat lui-mêmeNon vérifiéNous le citons ; nous ne l’avons pas mesuré.

Même entreprise, même outil ou même secteur.

3x“Baseten’s throughput and latency optimizations delivered 3x savings versus the equivalent closed-source model”Parallel Web Systems utilise Baseten. Un autre client de Baseten33%“High cache hit rates and cache token pricing enabled OpenCode to achieve a 33% blended cost reduction versus their previous providers.”OpenCode utilise Baseten. Un autre client de Baseten44%“Speechify's cost per million characters dropped by 44%”Speechify utilise Baseten. Un autre client de Baseten