Lunary ist eine Plattform für Observability und Evaluierung von Anwendungen auf Basis großer Sprachmodelle (LLMs). Sie hilft Engineering- und Produktteams dabei, zu sehen, wie sich KI-Features in der Produktion verhalten, und Probleme schnell zu lokalisieren.
Observability und Analytics für LLMs
Lunary erfasst Request-Logs, Model-Outputs und wichtige Qualitätsmetriken, damit Sie nachvollziehen können, was in Ihren KI-Workflows passiert.
Performance, Zuverlässigkeit und Kosten im Zeitverlauf verfolgen
Nutzerkonversationen mit Chatbots analysieren
Erkennen, wo Antworten fehlschlagen, abweichen oder Erwartungen nicht erfüllen
Prompt-Management und Experimente
Lunary enthält Tools, um Prompts als Workflow zu verwalten und die Qualität ohne ad-hoc Codeänderungen zu verbessern.
Versionierung und Vergleiche von Prompts
A/B-Tests und Evaluierungen
Strukturierte Iteration von Prompt-Formulierungen und Verhalten
Für Startups und Enterprise entwickelt
Lunary kann sowohl für interne KI-Tools als auch für kundenorientierte Produkte verwendet werden. Teams erhalten einen klareren Blick auf das LLM-Verhalten und Daten, die Produktentscheidungen unterstützen, statt das Modell als Blackbox zu behandeln.

