Skip to main content
AI Guardrails ermöglichen Enterprise-Administrator:innen, Guardrails dafür zu definieren, wie Nutzer:innen organisationsweit mit Devin interagieren. Die Guardrails prüfen eingehende Nutzernachrichten automatisch – einschließlich erster Nachrichten, Folgenachrichten und Kommentaren in Pull Requests (PRs) – um Prompt-Injection, Versuche zur Datenexfiltration und Richtlinienverstöße zu erkennen, bevor Devin sie verarbeitet.

Überblick

Guardrails fungieren als zusätzliche Kontrollinstanz für Nachrichten, die an Devin gesendet werden. Sie analysieren Nutzernachrichten in Echtzeit und können:
  • Verdächtige Nachrichten protokollieren zur Überprüfung (log_only)
  • Den Benutzer warnen mit einem sichtbaren Banner, während die Nachricht weiterhin verarbeitet wird (warn_user)
  • Nachrichten blockieren, die gegen Richtlinien der Organisation verstoßen (block_message)

Guardrails konfigurieren

Guardrails werden auf Enterprise-Ebene unter Settings > Guardrails von Administratoren mit der Berechtigung Enterprise-Einstellungen verwalten konfiguriert. Die Einstellung eines Guardrails gilt für alle Organisationen im Enterprise — Guardrails können nicht für einzelne Organisationen konfiguriert werden, und die Organization Settings verfügen über keine eigene Guardrails-Seite. Die Seite hat zwei Tabs:
  • Guardrails — Die vorkonfigurierten Guardrails, gruppiert in Kategorien wie Datenkontrollen und Datenschutz und Zulässige Nutzung. Wählen Sie ein Guardrail aus, um die Beschreibung und Beispielnachrichten anzuzeigen.
  • Violations — Ein Diagramm der Verstöße im Zeitverlauf sowie eine Tabelle der erfassten Verstöße, die nach Guardrail und nach Organisation innerhalb des Enterprise gefiltert werden kann. Jede Zeile verweist zur Untersuchung auf die ursprüngliche Sitzung.
Jedes Guardrail verfügt über ein einzelnes Dropdown, über das es aktiviert und die bei einem Verstoß ausgeführte Aktion festgelegt wird:
Das Beenden einer Sitzung bei einem Verstoß (kill_session) ist keine konfigurierbare Aktion. Der Wert kann weiterhin bei historischen Verstößen angezeigt werden, die erfasst wurden, als diese Aktion noch konfigurierbar war.

Guardrail-Ereignisse

Wenn ein Guardrail ausgelöst wird, protokolliert Devin das Ereignis mit Details, einschließlich:
  • der Nutzernachricht, die das Guardrail ausgelöst hat
  • der Guardrail-Regel, auf die es zutraf
  • der ergriffenen Aktion (log_only, warn_user oder block_message)
  • einem Link zu der Sitzung, in der das Ereignis aufgetreten ist
Guardrail-Ereignisse erscheinen in den Audit-Logs mit dem Aktionstyp ai_guardrail_violation und ermöglichen automatisierte Überwachung und Benachrichtigungen. Sie können Guardrail-Ereignisse auch programmgesteuert über die API für Guardrail-Verstöße abrufen.

Anwendungsfälle

Zu den gängigen Guardrail-Konfigurationen gehören:
  • Erkennung von Prompt-Injection — Erkennen und Blockieren von Nutzernachrichten, die versuchen, Devins Anweisungen zu überschreiben oder sein Verhalten zu manipulieren
  • Verhinderung von Datenexfiltration — Markieren oder Blockieren von Nachrichten, die versuchen, Devin anzuweisen, vertrauliche Daten an nicht autorisierte Ziele zu senden
  • Durchsetzung der Einhaltung von Richtlinien — Überprüfen von Nutzeranfragen, um sicherzustellen, dass sie mit den Sicherheits- und Nutzungsrichtlinien der Organisation übereinstimmen
AI Guardrails ist eine Enterprise-Funktion. Wenden Sie sich an Ihr Account-Team, um mehr darüber zu erfahren, wie Sie Guardrails für Ihre Organisation aktivieren können.