Skip to main content
如需更详细的 Datadog 集成指南,请点击此处
1

启用 Datadog MCP

Devin 需要访问你的 Datadog 账户,以便在排查问题时查询日志、指标和监控。
  1. 前往 Settings > Connections > MCP servers 并找到 Datadog
  2. 点击 Enable,选择你的 Datadog 站点/区域,并输入你的 DD-API-KEYDD-APPLICATION-KEY —— 可在 Datadog > Organization Settings > API Keys 中生成这些密钥
  3. 点击 Test listing tools 以验证 Devin 是否能够成功连接
启用后,Devin 可以在单次会话中查询错误日志、拉取指标时间序列数据、列出活动监控项并搜索追踪。了解更多关于连接 MCP 服务器的信息。
2

构建告警到 Devin 的桥接通道

你需要一个小型服务,用于接收告警 webhook,并通过 Devin API 发起 Devin 会话。将其部署为无服务器函数 (AWS Lambda、Cloudflare Worker) 或轻量级容器:
app.devin.aiSettings > Service Users 中创建一个服务用户,并授予 ManageOrgSessions 权限。复制创建后显示的 API 令牌,并将其作为 DEVIN_API_KEY 存储在你的桥接服务中。将 DEVIN_ORG_ID 设置为你的组织 ID —— 使用你的令牌调用 GET https://api.devin.ai/v3/enterprise/organizations 来获取该值。上面的代码使用了 !triage 模板 playbook —— 复制一份,并根据你的技术栈自定义排查步骤,然后在你的桥接服务中更新 playbook_id
3

将告警路由到 Webhook 端点

直接在 Datadog 中配置:
  1. 在 Datadog 仪表板中,进入 Integrations > Webhooks
  2. 点击 New Webhook,并将 URL 设置为你的 bridge endpoint (例如:https://your-bridge.example.com/alert)
  3. 在任意监控的通知消息中添加 @webhook-devin-bridge —— 每当该监控触发时,Devin 都会进行排查
从 PagerDuty 配置:
  1. 在 PagerDuty 中,进入 Services > [your service] > Integrations
  2. 添加一个 Generic Webhooks (v3) 集成
  3. 将 webhook URL 设置为你的 bridge endpoint,并按事件类型 incident.triggered 进行过滤
先从 warning 级别的监控开始,用来测试整个流程,然后再路由关键告警。
4

Devin 会分析什么

当告警触发一个会话时,Devin 使用 Datadog MCP 来执行结构化排查——查询日志、关联部署变更,并将错误追溯到源代码。Devin 在 Slack 中发布的示例排查结果:
5

扩展流水线

在基础排查流程跑通后,再逐步叠加更多自动化能力:自定义分诊手册 (triage playbook) 。 bridge 代码已经在使用 !triage 模板 playbook。复制一份,并根据你团队的技术栈定制排查清单——添加各服务专属的运行手册、升级路径,以及紧急修复 PR (拉取请求) 的处理规范。按严重级别划分处理策略。 将 P1 告警路由为需要立刻排查并紧急修复的事件。将 P3 告警仅路由为根因分析使用。针对不同严重级别使用不同的提示词或 playbook。为你的服务添加 Knowledge ——例如正常阈值、架构说明、值班运行手册——这样 Devin 的排查就能从你团队的上下文出发,而不是从零开始。