Visão geral
Os guardrails funcionam como uma camada adicional de supervisão em mensagens enviadas para o Devin. Eles analisam mensagens de usuários em tempo real e podem:- Registrar mensagens suspeitas para revisão (
log_only) - Avisar o usuário com um banner visível enquanto a mensagem ainda é processada (
warn_user) - Bloquear mensagens que violem as políticas da organização (
block_message)
Configurando Guardrails
Os Guardrails são configurados no nível Enterprise, em Configurações > Guardrails, por administradores com a permissão Gerenciar configurações Enterprise. A configuração de cada guardrail se aplica a todas as organizações do Enterprise — não é possível configurar guardrails por organização, e as configurações da organização não têm uma página própria de Guardrails. A página tem duas abas:- Guardrails — Os guardrails predefinidos, agrupados em categorias como Controles de dados e privacidade e Uso aceitável. Selecione um guardrail para ver sua descrição e exemplos de mensagens.
- Violações — Um gráfico de violações ao longo do tempo e uma tabela de violações registradas, que podem ser filtradas por guardrail e por organização do Enterprise. Cada linha contém um link para a sessão de origem para investigação.
Encerrar uma sessão em caso de violação (
kill_session) não é uma ação configurável. O valor ainda pode aparecer em violações históricas registradas quando essa ação era configurável.Eventos de guardrail
Quando um guardrail é disparado, Devin registra o evento com detalhes, incluindo:- A mensagem do usuário que disparou o guardrail
- A regra de guardrail que foi acionada
- A ação executada (
log_only,warn_useroublock_message) - Um link para a sessão em que o evento ocorreu
ai_guardrail_violation, permitindo monitoramento e alerta automatizados. Você também pode recuperar eventos de guardrail de forma programática pela API de violações de guardrail.
Casos de uso
Configurações comuns de guardrails incluem:- Detecção de prompt injection — Identificar e bloquear mensagens de usuários que tentam substituir as instruções do Devin ou manipular seu comportamento
- Prevenção de exfiltração de dados — Marcar ou bloquear mensagens que tentam instruir o Devin a enviar dados confidenciais para destinos não autorizados
- Garantia de conformidade com políticas — Verificar solicitações de usuários para garantir que estejam alinhadas com as políticas organizacionais de segurança e uso
AI Guardrails é um recurso Enterprise. Entre em contato com a equipe da sua conta para saber mais sobre como ativar guardrails para sua organização.

