CoAgent 与企业生产 Agent 协作

提供异常发现、根因诊断、风险决策、受控处置和审计复盘能力

进入处置工作台
90s平均研判时延
3典型场景类型
🟢🟡🔴三级处置边界
01 · 业务挑战

Agent 规模化上线,运行态运维缺位

  • 静默失败限流、空检索等异常往往由业务方先感知
  • 处置路径不清重试、改 Prompt、换模型缺乏统一决策依据
  • 成本不可控Token 消耗超预算缺少分级响应机制
  • 执行风险高AI 建议缺乏可验证的置信度评估
  • 审计不完整处置过程、审批人与决策依据难以追溯
02 · 平台能力

可验证处置闭环

1
事件感知Webhook 接入 · 控制台实时推送
2
根因推理运维手册约束 · 结构化因果链
3
把握度评分数据 · 手册 · 推理 三因子可审计
4
分级处置🟢 可执行 / 🟡 需确认 / 🔴 须升级

总分 = round(100 × (0.35×数据 + 0.35×手册 + 0.30×推理))

03 · 运行成效

统一评分引擎,差异化处置策略

87 API 限流 47 次/5min · 失败率 38% · 分钟级发现,建议重试
72 空检索异常 空检索率 35% · 禁止盲重试,须更新知识库
58 成本超预算 ¥28.5 / ¥20 · 强制升级至负责人审批

把握度评分定义动作权限边界——同类失败事件,处置策略因根因而异

标准响应流程

进入处置工作台
  1. 事件接入 — Webhook 上报或控制台演练注入
  2. 场景路由 — 按 (type, symptom) 匹配运维手册
  3. 工具查询 — 拉取指标、配置与手册条目
  4. 根因推理 — LLM 生成因果链与处置步骤
  5. 把握度评分 — 三因子计算,输出 🟢🟡🔴 分级
  6. 分级处置 — 执行 / 确认 / 升级,同步 IM 通道
  7. 审计归档 — 全链路留痕,反馈驱动手册迭代

Agent 把握度 · 实时状态

事件触发后更新
cs-bot
87
rag-bot
72
content-bot
58

处置流水线 · 实时时间线

在处置工作台触发事件或注入演练场景后,完整流水线将在此实时展示