概览
- 记录 可疑消息以供审查 (
log_only) - 警告 用户,在继续处理消息的同时显示可见横幅 (
warn_user) - 阻止 违反组织策略的消息 (
block_message)
配置护栏
- 护栏 — 按 数据控制与隐私、可接受使用 等类别分组的预设护栏。选择护栏可查看其说明和示例消息。
- 违规 — 展示一段时间内违规情况的图表,以及已记录违规的表格;可按护栏和企业内的组织进行过滤。每一行均链接到相应的来源会话,便于调查。
发生违规时终止会话 (
kill_session) 不是可配置的操作。该值仍可能出现在其可配置期间记录的历史违规中。护栏事件
- 触发护栏的用户消息
- 匹配到的护栏规则
- 所采取的操作 (
log_only,warn_user, orblock_message) - 事件发生所在会话的链接
ai_guardrail_violation 操作类型显示在审计日志中,从而支持自动化监控和告警。你还可以通过护栏违规 API以编程方式检索护栏事件。
使用场景
- 检测提示注入 (prompt injection) — 识别并拦截试图覆盖 Devin 指令或操控其行为的用户消息
- 防止数据外泄 — 标记或拦截试图指示 Devin 将敏感数据发送到未授权目标的消息
- 强制执行策略合规 — 审核用户请求,确保其符合组织的安全和使用政策
AI Guardrails 是一项企业版功能。请联系您的客户团队,了解如何为您的组织启用防护栏。

