ModelRed ist ein Sicherheitstool für KI-Systeme, das Red Teaming für LLMs und Agents automatisiert. Es führt große, sich weiterentwickelnde Angriffssätze aus, um Schwachstellen aufzudecken und zu zeigen, wie gut ein System auf reale Bedrohungen vorbereitet ist.
LLMs, Agents und RAG-Pipelines testen
ModelRed funktioniert mit jedem KI-System vom Typ „Text rein, Text raus“. Sie können Modelle, KI-Agents, RAG-Pipelines und benutzerdefinierte APIs testen, um Probleme zu erkennen, bevor Nutzer sie sehen.
Jailbreaks und unsicheres Verhalten
Schwachstellen durch Prompt-Injection
Risiken durch Datenlecks
Andere unsichere oder nicht konforme Antworten
Sicherheitsmetriken und Berichte
Nach einem Testlauf erstellt ModelRed einen AI Security Score und detaillierte Berichte zu Schwachstellen. Die Ergebnisse umfassen, wie viele Angriffe ausgeführt wurden, was gefunden wurde, die Schwere, die Bestehensquote und weitere Robustheitsmetriken.
Live-Tests mit aktiven Prüfungen
Erfassung der durchschnittlichen Antwortzeit
Schnelles Setup für Engineering-Teams
ModelRed wurde für Entwickler- und Sicherheitsteams entwickelt, die vor dem Produktivstart eine schnelle Prüfung benötigen. Es lässt sich in wenigen Minuten anbinden und dann für Testkampagnen sowie zur Verfolgung des Fortschritts über Metriken und Protokolle nutzen.

