Lunary est une plateforme d’observabilité et d’évaluation pour les applications basées sur de grands modèles de langage (LLM). Elle aide les équipes d’ingénierie et produit à comprendre comment les fonctionnalités IA se comportent en production et à repérer rapidement les problèmes.
Observabilité et analytique pour les LLM
Lunary collecte les journaux de requêtes, les sorties des modèles et des indicateurs clés de qualité afin que vous puissiez comprendre ce qui se passe dans vos workflows IA.
Suivre les performances, la fiabilité et les coûts dans le temps
Analyser les conversations des utilisateurs avec les chatbots
Identifier les cas où les réponses échouent, dérivent ou ne correspondent pas aux attentes
Gestion des prompts et expérimentation
Lunary inclut des outils pour gérer les prompts comme un workflow, ce qui facilite l’amélioration de la qualité sans modifications de code au cas par cas.
Versioning des prompts et comparaisons
Tests A/B et évaluations
Itération structurée sur le wording et le comportement des prompts
Conçu pour les startups et les entreprises
Lunary peut être utilisé aussi bien pour des outils IA internes que pour des produits destinés aux clients. Les équipes obtiennent une vision plus claire du comportement des LLM et des données pour appuyer les décisions produit, au lieu de traiter le modèle comme une boîte noire.

