Ir al contenido principal
usedby

30%

“30% lower cost per call”

Tal como se publicó en baseten.co, agosto de 2026. Verificado por usedby el 9 oct 2026.

Qué pasó

You.com runs open-source LLMs on Baseten's dedicated, multi-region deployments to handle the synthesis step of its Answer API, turning retrieved passages into cited, verified answers instead of routing each query to a frontier model.

Resumen escrito por usedby a partir de la página de origen, en inglés. Las cifras son de Baseten y de you.com, no nuestras.

  • 93.48%“93.48% accuracy on SimpleQA, 2.67-second p50 latency, and $5 per 1,000 calls.”

Compared with routing synthesis to a frontier model, You.com saw:

De la página. baseten.co

We think open-weight models plus web search is a powerful alternative to routing everything through frontier model providers, at a fraction of the price and comparable quality for our developers.

Saahil Jain, CTO, You.com. Fuente

Lo que dice la historia, y lo que verificamos

Lo que comparamos con la página.

  • La cifra: 30%VerificadoImpresa palabra por palabra en la página, cerca del nombre de you.com.
  • El pasaje citado arribaVerificadoCopiado palabra por palabra de la página, cerca del nombre de you.com.
  • La fecha de publicaciónVerificadoLeída en los metadatos de la propia página, nunca adivinada.
  • you.com usa BasetenVerificadoLínea de nivel Confirmado.
  • El resultado en síNo verificadoLo citamos; no lo medimos.

Misma empresa, misma herramienta o mismo sector.

3x“Baseten’s throughput and latency optimizations delivered 3x savings versus the equivalent closed-source model”Parallel Web Systems usa Baseten. Otro cliente de Baseten33%“High cache hit rates and cache token pricing enabled OpenCode to achieve a 33% blended cost reduction versus their previous providers.”OpenCode usa Baseten. Otro cliente de Baseten44%“Speechify's cost per million characters dropped by 44%”Speechify usa Baseten. Otro cliente de Baseten