人工审查
Human review
用户阅读 Agent 生成的代码,并对其作出判断。阅读 diff 或改动后的文件算人工审查;阅读 Agent 对自己所做工作的描述则不算,因为叙述不是产物本身。这类描述是由被审查方写成的二手来源;diff 才是一手来源,而审查意味着亲自阅读它。
Agent 会提升代码产量,因此审查会成为瓶颈。一种有效思路是将不同审查策略分层。自动化检查发现机械性故障,自动审查发现能够描述和判断的问题,人工审查则留给只有你才能判断的事项:这项改动是否是正确的改动、方案是否适合这个代码库,以及这项功能究竟是否应该存在。
越早审查,成本也越低。在工作开始前阅读计划,或在执行中途查看一个小 diff,只需几分钟;AFK 运行结束后再去挖掘整个已完成的分支,则耗时更长。把审查检查点放在哪里,是一项 human-in-the-loop 决策,而不该事后才想起来。
避免单独使用:“代码审查”——它无法明确区分人工审查和自动审查。
用法:
“我人工审查了 AFK 的输出。”
“你读了 diff,还是只看了摘要?”
“读了 diff。摘要说它删除了无用代码,结果那个函数其实被一个生成文件调用了。”