33%
“High cache hit rates and cache token pricing enabled OpenCode to achieve a 33% blended cost reduction versus their previous providers.”
Tel que publié sur baseten.co, juin 2026. Vérifié par usedby le 9 oct. 2026.
Ce qui s’est passé
OpenCode, an open-source AI coding agent, uses Baseten's Model APIs to serve open-source models through its Zen gateway. It relies on Baseten for fast, reliable inference with KV cache aware routing, cache token pricing, and dependable tool calling.
Résumé rédigé par usedby à partir de la page source, en anglais. Les chiffres sont ceux de Baseten et de OpenCode, pas les nôtres.
- 5x“5x TPS and higher stability versus closed-source providers”
- 100+ TPS“100+ TPS consistently across open-source models”
- 10M MAUs“OpenCode has grown from roughly 40k MAUs at the start of the partnership to 10M MAUs, with Baseten serving as one of their core inference providers across multiple models amidst massive user growth.”
High cache hit rates and cache token pricing enabled OpenCode to achieve a 33% blended cost reduction versus their previous providers. OpenCode passed those savings directly to their users with discounted usage for Zen users.
Ever since the launch of Zen, we've gotten a lot of crazy feedback — it's fast and very good, like 90% as good as SOTA closed-source models, but it's just so fast that it changes people's behavior when they code.
Ce que dit le témoignage, et ce que nous avons vérifié
Ce que nous avons comparé à la page.
- Le chiffre : 33%VérifiéImprimé mot pour mot sur la page, près du nom de OpenCode.
- L’extrait cité plus hautVérifiéCopié mot pour mot depuis la page, près du nom de OpenCode.
- La date de publicationVérifiéLue dans les métadonnées de la page, jamais devinée.
- OpenCode utilise BasetenVérifiéLigne de niveau Confirmé.
- Le résultat lui-mêmeNon vérifiéNous le citons ; nous ne l’avons pas mesuré.




