Rhesis AI est un outil open source pour tester les applications basées sur des LLM et des agents. Il aide les équipes d’ingénierie, produit et analytics à centraliser les exigences, puis utilise l’IA pour générer de larges ensembles de scénarios de test.
Gestion collaborative de la qualité
Au lieu de feuilles de calcul dispersées et de cas de test manuels, les équipes documentent directement dans Rhesis AI le comportement attendu du modèle. Le système transforme ces attentes en tests structurés couvrant différents embranchements de dialogue et cas limites, afin d’aider à détecter plus tôt les problèmes liés à :
la logique applicative
les prompts
la configuration du modèle
Tests automatisés pour les conversations multi-tours
Rhesis AI simule des conversations en plusieurs étapes avec des LLM et des agents. Vous pouvez valider l’évolution des réponses avec un long contexte, des instructions complexes et des demandes utilisateur inhabituelles. Cela permet des contrôles qualité fondés sur des usages réels, et pas seulement sur des prompts à tour unique.
Open source avec intégration au workflow de développement
Rhesis AI est distribué en open source et inclut un SDK. Il peut être intégré aux pipelines de développement existants pour :
CI/CD
la revue des changements
les tests de régression
Cela crée un processus transparent et reproductible pour vérifier les fonctionnalités LLM selon les standards d’ingénierie internes.

