Skip to main content
Los AI Guardrails permiten a los administradores de Enterprise definir límites de seguridad para la forma en que los usuarios interactúan con Devin en toda la organización. Estos guardrails revisan automáticamente los mensajes entrantes de los usuarios —incluidos los mensajes iniciales, los mensajes de seguimiento y los comentarios de PR (pull request)— para detectar intentos de prompt injection, exfiltración de datos y violaciones de políticas antes de que Devin los procese.

Overview

Los guardrail se ejecutan como una capa adicional de supervisión sobre los mensajes enviados a Devin. Analizan los mensajes de los usuarios en tiempo real y pueden:
  • Registrar mensajes sospechosos para su revisión (log_only)
  • Advertir al usuario con un banner visible mientras se sigue procesando el mensaje (warn_user)
  • Bloquear mensajes que infringen las políticas de la organización (block_message)

Configuración de guardrails

Los guardrails se configuran a nivel de Enterprise, en Settings > Guardrails, por administradores con el permiso Manage enterprise settings. La configuración de cada guardrail se aplica a todas las organizaciones de Enterprise: no se pueden configurar guardrails por organización y los Settings de organización no tienen su propia página de Guardrails. La página tiene dos pestañas:
  • Guardrails — Los guardrails predefinidos, agrupados en categorías como Controles de datos y privacidad y Uso aceptable. Seleccione un guardrail para ver su descripción y mensajes de ejemplo.
  • Violations — Un gráfico de infracciones a lo largo del tiempo y una tabla de infracciones registradas, que se pueden filtrar por guardrail y por organización dentro de Enterprise. Cada fila enlaza con la sesión de origen para su investigación.
Cada guardrail tiene un único menú desplegable que permite habilitarlo y establecer la acción que se realiza en caso de infracción:
Terminar una sesión por una infracción (kill_session) no es una acción configurable. El valor puede seguir apareciendo en infracciones históricas registradas cuando era configurable.

Guardrail Events

Cuando se activa un guardrail, Devin registra el evento con detalles que incluyen:
  • El mensaje del usuario que activó el guardrail
  • La regla de guardrail que coincidió
  • La acción realizada (log_only, warn_user o block_message)
  • Un enlace a la sesión donde ocurrió el evento
Los eventos de guardrail aparecen en los registros de auditoría con el tipo de acción ai_guardrail_violation, lo que permite el monitoreo y las alertas automatizados. También puedes recuperar eventos de guardrail de forma programática mediante la API de infracciones de guardrails.

Casos de uso

Las configuraciones de guardrails más comunes incluyen:
  • Detección de prompt injection — Identificar y bloquear mensajes de usuario que intentan anular las instrucciones de Devin o manipular su comportamiento
  • Prevención de exfiltración de datos — Marcar o bloquear mensajes que intentan instruir a Devin para que envíe datos sensibles a destinos no autorizados
  • Garantizar el cumplimiento de políticas — Analizar las solicitudes de los usuarios para asegurarse de que se alineen con las políticas de seguridad y uso de la organización
AI Guardrails es una funcionalidad de Enterprise. Ponte en contacto con tu equipo de cuentas para obtener más información sobre cómo habilitar guardrails para tu organización.