30%
“30% lower cost per call”
Tel que publié sur baseten.co, août 2026. Vérifié par usedby le 9 oct. 2026.
Ce qui s’est passé
You.com runs open-source LLMs on Baseten's dedicated, multi-region deployments to handle the synthesis step of its Answer API, turning retrieved passages into cited, verified answers instead of routing each query to a frontier model.
Résumé rédigé par usedby à partir de la page source, en anglais. Les chiffres sont ceux de Baseten et de you.com, pas les nôtres.
- 93.48%“93.48% accuracy on SimpleQA, 2.67-second p50 latency, and $5 per 1,000 calls.”
Compared with routing synthesis to a frontier model, You.com saw:
We think open-weight models plus web search is a powerful alternative to routing everything through frontier model providers, at a fraction of the price and comparable quality for our developers.
Ce que dit le témoignage, et ce que nous avons vérifié
Ce que nous avons comparé à la page.
- Le chiffre : 30%VérifiéImprimé mot pour mot sur la page, près du nom de you.com.
- L’extrait cité plus hautVérifiéCopié mot pour mot depuis la page, près du nom de you.com.
- La date de publicationVérifiéLue dans les métadonnées de la page, jamais devinée.
- you.com utilise BasetenVérifiéLigne de niveau Confirmé.
- Le résultat lui-mêmeNon vérifiéNous le citons ; nous ne l’avons pas mesuré.




