审查Review
这条 PR 该花多少时间、看哪里
理念
AI 把 PR 产出速度提高了一个数量级,评审能力没有跟着变。
受监管行业(金融 / 医疗 / 汽车)不能接受「全看」也不能接受「少看」—— 全看让评审变成签字仪式;少看让治理变成信仰。
Steer 给的是第三条路:每条 PR 进站时被定一个档位(L0–L4),高风险的被看见,低风险的被放行。同样的评审人力,分到了该分的地方。
机制
审查回答"这条 PR 该花多少时间、看哪里";一致性回答"diff 和计划对不对得上";边界回答"agent 在哪些地方可以自己走"。每一轮覆写、归因、合并后修复,全部回流成新的档位与策略。
这条 PR 该花多少时间、看哪里
diff 和计划对不对得上
agent 在哪些地方可以自己走
五档 —— 从 2% 抽检到必须有人签字
升档要人批,降档不要人批。信任谨慎建立,迅速收回。
实践
评审者、tech lead、审计,各自只拿到自己要做决定的那部分。
评审者
周一早上打开 Slack
看到一份「上周 PR 清单」,按风险从高到低排好。每条标了档位、标了应该看哪个 hunk、标了预估的分钟数。
tech lead
打开控制台 /governance/matrix
看到自治矩阵 — 哪些目录 × 任务类型可以信任 agent 自主走、哪些目录永远要人签字。点击格子,看证据,决定是否升降档。
审计 / 合规
任何时候拉一份 HTML 报告
看到过去 12 个月每条 PR 的判定、命中规则、判定耗时、归因链路。能向董事会讲清「我们是怎么 review 的」,而不是「我们尽力了」。
落地
每一步独立可交付、可验收、可中止 —— 在任何一步停下都拿到了完整的东西。
对过去 12 个月的 PR 算路由,对账实际逃逸缺陷。
只读 · 自包含 HTML
给 open PR 实时打分、存库,不露任何界面。
客户侧 PR 零产品痕迹
把这套判定接到自己的控制台、Webhook、Slack。
demo 数据可一键删除
覆写事件 → 边界提案 → 升降档生效,下一轮审查自动用新档位。
升档要人批 · 降档自动