Überblick
Guardrails fungieren als zusätzliche Kontrollinstanz für Nachrichten, die an Devin gesendet werden. Sie analysieren Nutzernachrichten in Echtzeit und können:- Verdächtige Nachrichten protokollieren zur Überprüfung (
log_only) - Den Benutzer warnen mit einem sichtbaren Banner, während die Nachricht weiterhin verarbeitet wird (
warn_user) - Nachrichten blockieren, die gegen Richtlinien der Organisation verstoßen (
block_message)
Guardrails konfigurieren
Guardrails werden auf Enterprise-Ebene unter Settings > Guardrails von Administratoren mit der Berechtigung Enterprise-Einstellungen verwalten konfiguriert. Die Einstellung eines Guardrails gilt für alle Organisationen im Enterprise — Guardrails können nicht für einzelne Organisationen konfiguriert werden, und die Organization Settings verfügen über keine eigene Guardrails-Seite. Die Seite hat zwei Tabs:- Guardrails — Die vorkonfigurierten Guardrails, gruppiert in Kategorien wie Datenkontrollen und Datenschutz und Zulässige Nutzung. Wählen Sie ein Guardrail aus, um die Beschreibung und Beispielnachrichten anzuzeigen.
- Violations — Ein Diagramm der Verstöße im Zeitverlauf sowie eine Tabelle der erfassten Verstöße, die nach Guardrail und nach Organisation innerhalb des Enterprise gefiltert werden kann. Jede Zeile verweist zur Untersuchung auf die ursprüngliche Sitzung.
Das Beenden einer Sitzung bei einem Verstoß (
kill_session) ist keine konfigurierbare Aktion. Der Wert kann weiterhin bei historischen Verstößen angezeigt werden, die erfasst wurden, als diese Aktion noch konfigurierbar war.Guardrail-Ereignisse
Wenn ein Guardrail ausgelöst wird, protokolliert Devin das Ereignis mit Details, einschließlich:- der Nutzernachricht, die das Guardrail ausgelöst hat
- der Guardrail-Regel, auf die es zutraf
- der ergriffenen Aktion (
log_only,warn_useroderblock_message) - einem Link zu der Sitzung, in der das Ereignis aufgetreten ist
ai_guardrail_violation und ermöglichen automatisierte Überwachung und Benachrichtigungen. Sie können Guardrail-Ereignisse auch programmgesteuert über die API für Guardrail-Verstöße abrufen.
Anwendungsfälle
Zu den gängigen Guardrail-Konfigurationen gehören:- Erkennung von Prompt-Injection — Erkennen und Blockieren von Nutzernachrichten, die versuchen, Devins Anweisungen zu überschreiben oder sein Verhalten zu manipulieren
- Verhinderung von Datenexfiltration — Markieren oder Blockieren von Nachrichten, die versuchen, Devin anzuweisen, vertrauliche Daten an nicht autorisierte Ziele zu senden
- Durchsetzung der Einhaltung von Richtlinien — Überprüfen von Nutzeranfragen, um sicherzustellen, dass sie mit den Sicherheits- und Nutzungsrichtlinien der Organisation übereinstimmen
AI Guardrails ist eine Enterprise-Funktion. Wenden Sie sich an Ihr Account-Team, um mehr darüber zu erfahren, wie Sie Guardrails für Ihre Organisation aktivieren können.

