33%
“High cache hit rates and cache token pricing enabled OpenCode to achieve a 33% blended cost reduction versus their previous providers.”
Tal como se publicó en baseten.co, junio de 2026. Verificado por usedby el 9 oct 2026.
Qué pasó
OpenCode, an open-source AI coding agent, uses Baseten's Model APIs to serve open-source models through its Zen gateway. It relies on Baseten for fast, reliable inference with KV cache aware routing, cache token pricing, and dependable tool calling.
Resumen escrito por usedby a partir de la página de origen, en inglés. Las cifras son de Baseten y de OpenCode, no nuestras.
- 5x“5x TPS and higher stability versus closed-source providers”
- 100+ TPS“100+ TPS consistently across open-source models”
- 10M MAUs“OpenCode has grown from roughly 40k MAUs at the start of the partnership to 10M MAUs, with Baseten serving as one of their core inference providers across multiple models amidst massive user growth.”
High cache hit rates and cache token pricing enabled OpenCode to achieve a 33% blended cost reduction versus their previous providers. OpenCode passed those savings directly to their users with discounted usage for Zen users.
Ever since the launch of Zen, we've gotten a lot of crazy feedback — it's fast and very good, like 90% as good as SOTA closed-source models, but it's just so fast that it changes people's behavior when they code.
Lo que dice la historia, y lo que verificamos
Lo que comparamos con la página.
- La cifra: 33%VerificadoImpresa palabra por palabra en la página, cerca del nombre de OpenCode.
- El pasaje citado arribaVerificadoCopiado palabra por palabra de la página, cerca del nombre de OpenCode.
- La fecha de publicaciónVerificadoLeída en los metadatos de la propia página, nunca adivinada.
- OpenCode usa BasetenVerificadoLínea de nivel Confirmado.
- El resultado en síNo verificadoLo citamos; no lo medimos.




