检查 AI Agent 的产出

AI Agent 说「完成了」之后,先按需求走一遍。页面出现只是起点,数据有没有保存、限制是否生效、改动能否构建,还需要分别确认。

先像用户一样操作

第一个功能里新增、刷新、修改、再尝试非法输入的那一套,就是这种检查:正常路径要走通,数据要真正保存,限制要在失败情况下生效。

如果需求涉及权限,还要换账号检查。管理员能够打开页面,不能证明普通用户的数据范围正确;按钮隐藏也不能代替接口权限检查。

再看改动是否围绕需求

让 AI Agent 说明新增和修改了哪些文件。已经使用 Git 的项目可以查看:

git status --short
git diff

git diff 不显示尚未跟踪的新文件,所以两条都要看。重点确认页面、接口和数据库改动之间能够对应,已有功能没有被无关修改,配置文件中的密钥没有进入提交内容。

遇到数据库迁移,确认保留了已有数据;不要让 AI Agent 为修复一个字段就重建整个数据库。已合并的迁移应通过新的迁移修正,详细说明见改表结构。

运行项目自己的检查

在应用目录查看 package.json 的 scripts。默认模板提供以下命令:

pnpm typecheck
pnpm test
pnpm lint
pnpm build
检查主要能发现什么
typecheck类型、导入及接口声明不一致
test已有测试覆盖的行为是否通过
lint项目规则和部分代码问题
build客户端与服务端能否构建,服务端依赖是否进入产物

模板还提供 pnpm check,会依次执行 lint、格式、类型、测试和构建检查。命令成功不等于业务完全正确:没有测试文件时,pnpm test 也可能成功退出,仍需要实际操作验证。

比如,页面在开发环境可以打开,但服务端依赖只放在 devDependencies 中,部署后仍可能无法启动。构建检查可以帮助发现这类问题。

把问题准确交回去

不要只说「不行」。说明操作、期望和实际结果:

我新增了 ORD-001,点击保存后列表能看到。
刷新浏览器后这条订单消失了。
预期是刷新后仍然存在。
请检查页面是否调用了保存接口,以及接口是否写入数据库。
修复后重新验证新增、刷新和编辑,告诉我实际结果。

终端报错时附上执行目录、命令和完整错误。不要贴密钥、真实客户资料或包含登录凭据的配置。

如果 AI Agent 建议删除检查、强行转换类型或重置数据库,先让它说明原因和影响。目标是修好问题并复查原有功能。

保存这一轮的结果

确认本轮通过后,记录已经做好的行为和仍待处理的问题,再进入下一轮。复杂任务的分步方式见做复杂功能。