Visão geral
- Registrar mensagens suspeitas para revisão (
log_only) - Avisar o usuário com um banner visível enquanto a mensagem ainda é processada (
warn_user) - Bloquear mensagens que violem as políticas da organização (
block_message)
Configurando Guardrails
- Guardrails — Os guardrails predefinidos, agrupados em categorias como Controles de dados e privacidade e Uso aceitável. Selecione um guardrail para ver sua descrição e exemplos de mensagens.
- Violações — Um gráfico de violações ao longo do tempo e uma tabela de violações registradas, que podem ser filtradas por guardrail e por organização do Enterprise. Cada linha contém um link para a sessão de origem para investigação.
Encerrar uma sessão em caso de violação (
kill_session) não é uma ação configurável. O valor ainda pode aparecer em violações históricas registradas quando essa ação era configurável.Eventos de guardrail
- A mensagem do usuário que disparou o guardrail
- A regra de guardrail que foi acionada
- A ação executada (
log_only,warn_useroublock_message) - Um link para a sessão em que o evento ocorreu
ai_guardrail_violation, permitindo monitoramento e alerta automatizados. Você também pode recuperar eventos de guardrail de forma programática pela API de violações de guardrail.
Casos de uso
- Detecção de prompt injection — Identificar e bloquear mensagens de usuários que tentam substituir as instruções do Devin ou manipular seu comportamento
- Prevenção de exfiltração de dados — Marcar ou bloquear mensagens que tentam instruir o Devin a enviar dados confidenciais para destinos não autorizados
- Garantia de conformidade com políticas — Verificar solicitações de usuários para garantir que estejam alinhadas com as políticas organizacionais de segurança e uso
AI Guardrails é um recurso Enterprise. Entre em contato com a equipe da sua conta para saber mais sobre como ativar guardrails para sua organização.

