低置信度核实:从调查结论到二次审计
· 阅读需 9 分钟
基于 sre-agent
feature/alert-verify-agent的 worker 设计与alert-verifyskill 落地整理。承接 SRE Agent 构建思考。
调查大约 5 分钟就能交出 planner_verdict,但低置信度结论仍会原样到达 oncall。证据薄、工具有缺口、推理方向可疑、预算耗尽后的 partial synthesis,都会让第一轮分析「看起来完整、其实站不住」。
alert-verify-agent 不是第二套调查入口。判断规则在 skill,不在框架:worker 只管消费、子进程和校验;「查什么、怎么判」只在 alert-verify。原则是 核实疑问,而不是默认重查一遍。目标是准确的结论,含准确地知道还不知道什么——禁止为凑 0.85 硬抬置信度。