30%
“30% lower cost per call”
Tal como se publicó en baseten.co, agosto de 2026. Verificado por usedby el 9 oct 2026.
Qué pasó
You.com runs open-source LLMs on Baseten's dedicated, multi-region deployments to handle the synthesis step of its Answer API, turning retrieved passages into cited, verified answers instead of routing each query to a frontier model.
Resumen escrito por usedby a partir de la página de origen, en inglés. Las cifras son de Baseten y de you.com, no nuestras.
- 93.48%“93.48% accuracy on SimpleQA, 2.67-second p50 latency, and $5 per 1,000 calls.”
Compared with routing synthesis to a frontier model, You.com saw:
We think open-weight models plus web search is a powerful alternative to routing everything through frontier model providers, at a fraction of the price and comparable quality for our developers.
Lo que dice la historia, y lo que verificamos
Lo que comparamos con la página.
- La cifra: 30%VerificadoImpresa palabra por palabra en la página, cerca del nombre de you.com.
- El pasaje citado arribaVerificadoCopiado palabra por palabra de la página, cerca del nombre de you.com.
- La fecha de publicaciónVerificadoLeída en los metadatos de la propia página, nunca adivinada.
- you.com usa BasetenVerificadoLínea de nivel Confirmado.
- El resultado en síNo verificadoLo citamos; no lo medimos.




