让 AI 对抗地评审自己的代码
把握程度:这次用下来确实有效,样本还小
用 AI 写代码,我最近越来越警惕的一点:风险不在它写不出来,而在它写出「看起来对、其实有边界 bug」的东西,而我一时审不过来。这次建站试了一套更狠的流程:
- 分维度找:让多个 AI 分别从正确性、可访问性、交互、一致性等角度各审一遍,而不是笼统「看看有没有问题」。
- 对抗地验:每一条被指出的问题,再派一个 AI 专门去反驳它,拿不准就判「不成立」。只有扛过反驳的才算数。
两个站这样跑下来,确认并修掉了三十多个真问题——其中最狠的那个(slug 三套算法不一致)单靠我自己肉眼是很难发现的。
它之所以有效,是因为把「生成」和「批判」分成了两个独立角色。这正好接上我早先那条判断:和 AI 结对时,评审能力比编码能力更值钱——现在连评审都可以外包给 AI,但设计这套流程、拍板信不信,还是我的事。