1K+ hours
“1K+ hours saved on manual evaluation per month through Patronus Judges”
Tel que publié sur patronus.ai. Capturé par usedby le 6 oct. 2026.
Ce qui s’est passé
Gamma's AI team uses Patronus Judges to automatically detect missing-content errors in generated slide decks, and Patronus Experiments to benchmark LLMs and distill a large set of user feedback samples into a smaller ground truth dataset.
Résumé rédigé par usedby à partir de la page source, en anglais. Les chiffres sont ceux de Patronus AI et de Gamma, pas les nôtres.
- 15+“15+ LLMs benchmarked with Patronus Experiments”
- 10K+“10K+ real world samples distilled into one coherent ground truth dataset”
Gamma’s task of slide deck generation resulted in long, open-ended outputs that were expensive to inspect manually and annotate. Patronus Judges excel for this challenge, where teams require a heuristic to grade thousands of samples.
Patronus helped our AI team find signals and patterns of error in our datasets. Their LLM Judges enabled us to triage errors and optimize our AI outputs in production settings. Patronus up-leveled our evaluation process and was an invaluable part of our workflow.
Ce que dit le témoignage, et ce que nous avons vérifié
Nous avons comparé le témoignage à sa page en ligne le 6 oct. 2026.
- Le chiffre : 1K+ hoursVérifiéImprimé mot pour mot sur la page, près du nom de Gamma.
- L’extrait cité plus hautVérifiéCopié mot pour mot depuis la page, près du nom de Gamma.
- Gamma utilise Patronus AIVérifiéLigne de niveau Confirmé. Dernière vérification, toutes sources confondues : 6 oct. 2026.
- Le résultat lui-mêmeNon vérifiéNous le citons ; nous ne l’avons pas mesuré.




