Présentation
Les garde-fous fonctionnent comme une couche supplémentaire de supervision appliquée aux messages envoyés à Devin. Ils analysent les messages des utilisateurs en temps réel et peuvent :- Consigner les messages suspects pour examen (
log_only) - Avertir l’utilisateur au moyen d’une bannière visible tout en continuant à traiter le message (
warn_user) - Bloquer les messages qui enfreignent les politiques de l’organisation (
block_message)
Configuration des garde-fous
Les garde-fous sont configurés au niveau de l’entreprise, dans Settings > Guardrails, par les administrateurs disposant de l’autorisation Gérer les paramètres d’entreprise. Le paramètre de chaque garde-fou s’applique à toutes les organisations de l’entreprise : les garde-fous ne peuvent pas être configurés par organisation, et les paramètres de l’organisation ne disposent pas de leur propre page Guardrails. La page comporte deux onglets :- Guardrails — Les garde-fous prédéfinis, regroupés en catégories telles que Contrôle des données et confidentialité et Utilisation acceptable. Sélectionnez un garde-fou pour afficher sa description et des exemples de messages.
- Violations — Un graphique des violations au fil du temps et un tableau des violations enregistrées, filtrables par garde-fou et par organisation au sein de l’entreprise. Chaque ligne renvoie à la session d’origine pour investigation.
Mettre fin à une session en cas de violation (
kill_session) n’est pas une action configurable. Cette valeur peut encore apparaître dans les violations historiques enregistrées lorsqu’elle était configurable.Événements de garde-fou
Lorsqu’un garde-fou est déclenché, Devin enregistre l’événement avec des détails tels que :- le message utilisateur qui a déclenché le garde-fou
- la règle de garde-fou correspondante
- l’action effectuée (
log_only,warn_useroublock_message) - un lien vers la session où l’événement s’est produit
ai_guardrail_violation, ce qui permet une surveillance et des alertes automatisées. Vous pouvez également récupérer les événements de garde-fou par programmation via l’API des violations de garde-fou.
Cas d’utilisation
Les configurations de garde-fous les plus courantes incluent :- Détection de l’injection de prompt — Identifier et bloquer les messages des utilisateurs qui tentent de remplacer les instructions de Devin ou de manipuler son comportement
- Prévention de l’exfiltration de données — Signaler ou bloquer les messages qui tentent d’instruire Devin afin qu’il envoie des données sensibles vers des destinations non autorisées
- Faire respecter les politiques — Filtrer les demandes des utilisateurs afin de s’assurer qu’elles sont conformes aux politiques de sécurité et d’utilisation de l’organisation
AI Guardrails est une fonctionnalité Enterprise. Contactez votre équipe en charge de votre compte pour en savoir plus sur l’activation d’AI Guardrails pour votre organisation.

