Skip to main content
Die Agentenbewertung bietet drei Sicherheitskontrollpunkte für agentenbasierte KI-Systeme: Toolaufrufe vor der Ausführung bewerten, Toolergebnisse scannen, bevor sie an den Agenten zurückgegeben werden, und Prompt-Injection in jedem Text erkennen, den der Agent verarbeiten will. Dies ist für Systeme gedacht, in denen ein KI-Agent eigenständig Tools (Funktionen, APIs, Retrieval) aufrufen kann. Wenn Ihre Anwendung nur Text generiert, können Sie dies überspringen und die Bewertung verwenden. Wenn Sie Agenten bauen, schützen diese Kontrollpunkte die Stellen, an denen ein Agent eine Aktion ausführen oder von ihr beeinflusst werden kann.

Die drei Kontrollpunkte

Tool Call Evaluation

ALLOW / FLAG / BLOCK, bevor ein Tool läuft.

Tool Result Scanning

PII-Erkennung und Injection-Prüfung auf Tool-Ausgaben.

Prompt Injection Detection

Schneller Injection-Scan auf beliebigem Eingabetext.
Integrieren Sie sie in der Reihenfolge, in der der Agent läuft: zuerst Injection auf eingehenden Eingaben erkennen, dann einen Toolaufruf vor seiner Ausführung bewerten, anschließend das Toolergebnis scannen, bevor es an den Agenten zurückgeht. Sie können einen Kontrollpunkt oder alle drei einsetzen; wenn Sie mit einem beginnen, bietet die Prompt-Injection-Erkennung auf Nutzereingaben den breitesten Schutz.

Schnelles Beispiel

Wie geht es weiter

API-Referenz: Tool Call

Vollständige Spezifikation für die Bewertung von Toolaufrufen.

Python SDK: Agentenbewertung

Python-SDK-Referenz für alle drei Agenten-Endpunkte.