Beschreibung
DKnownAI Guard ist eine spezialisierte API für die Sicherheit von KI-Agenten, die sich auf die Erkennung von Prompt-Injection, Jailbreak-Versuchen und der Extraktion von System-Prompts konzentriert. Sie wurde entwickelt, um KI-Agenten, die Aktionen ausführen, zu schützen und sicherzustellen, dass sie gegen Manipulationen geschützt bleiben, während sie weiterhin effektiv funktionieren. Die API klassifiziert Anfragen in vier verschiedene Risikokategorien: AGENT_HACK, SYS_FLAG, CONTENT_FLAG und SAFE. Dieses Klassifizierungssystem ermöglicht es Entwicklern, angemessen auf verschiedene Arten von Anfragen zu reagieren und die Sicherheit agentischer Workflows zu verbessern.
Die Kernfunktionalität von DKnownAI Guard dreht sich um die Fähigkeit, Manipulationsversuche zu erkennen, die auf KI-Agenten abzielen. Im Gegensatz zu traditionellen Inhaltsmoderationssystemen, die sich hauptsächlich auf schädlichen Text konzentrieren, priorisiert DKnownAI Guard die Identifizierung von täuschenden Taktiken, die darauf abzielen, das Verhalten von Agenten zu übernehmen. Dieser proaktive Ansatz ermöglicht es Entwicklern, bösartige Anfragen zu blockieren, ohne legitime Workflows zu stören. Wenn beispielsweise eine Anfrage versucht, den Agenten zu manipulieren, indem sie Befehle erteilt, die seine beabsichtigten Kontrollen überschreiben, wird DKnownAI Guard dies als AGENT_HACK klassifizieren und sofortige Blockierung empfehlen.
Neben seinen Fähigkeiten zur Manipulationserkennung bietet DKnownAI Guard auch kontextbewusste Erkennung. Durch die optionale Einbeziehung des Gesprächskontexts in Anfragen kann die API genauere Klassifizierungen liefern und die Latenz minimieren. Diese Funktion ist besonders vorteilhaft für Anwendungen, in denen KI-Agenten in mehrstufigen Gesprächen interagieren, da sie ein nuancierteres Verständnis von Absicht und Risiko ermöglicht.
DKnownAI Guard ist für die Agenten-Ära konzipiert, in der KI-Agenten erwartet werden, Code auszuführen, auf Dateien zuzugreifen und reale Systeme zu verwalten. Es unterstützt über 100 Sprachen und integriert sich nahtlos in verschiedene Agenten-Frameworks wie OpenClaw und Claude Code. Die API wurde entwickelt, um die Autonomie von KI-Agenten zu wahren und gleichzeitig sicherzustellen, dass sie gegen Manipulationen und operationale Risiken geschützt sind. Entwickler können mit einem kostenlosen Tarif beginnen, der 1.000 API-Aufrufe pro Monat ermöglicht, was es für Tests und erste Implementierungen zugänglich macht. Wenn die Anforderungen wachsen, ist ein Pro-Plan für 5.000 API-Aufrufe pro Monat verfügbar, der priorisierten Support und zusätzliche Funktionen bietet.
Insgesamt stellt DKnownAI Guard einen bedeutenden Fortschritt in der Sicherheit von KI dar, indem es sich auf die einzigartigen Herausforderungen konzentriert, die durch agentische KI-Systeme entstehen. Durch die Priorisierung der Manipulationserkennung und die Bereitstellung klarer Risikoklassifizierungen ermächtigt es Entwickler, sicherere und zuverlässigere KI-Anwendungen zu erstellen.
AI Agent Security API's Kernfunktionen
Erkennung von Prompt-Injection
Jailbreak-Abwehr
Schutz vor der Extraktion von System-Prompts
Vierstufige Risikoklassifizierung
Mehrsprachige Inhaltsdetektion
Integration in agentische Frameworks
Kontextbewusste Erkennung
Kostenloser Tarif verfügbar
Wie verwendet man AI Agent Security API?
Konfigurieren: Richten Sie Ihren API-Schlüssel im Authorization-Header ein.
Integrieren: Verwenden Sie die API in Ihren agentischen Workflows zur Erkennung von Prompt-Injection.
Klassifizieren: Senden Sie Anfragen an die API zur Klassifizierung von Benutzereingaben.
Reagieren: Handeln Sie basierend auf den von der API bereitgestellten Klassifizierungsergebnissen.
AI Agent Security API's Anwendungsfälle
- Sicherheit von Agenten
- Risikoklassifizierung
- Mehrstufige Gespräche
- Compliance-Überwachung
- Operationale Unterstützung






