作者做测试自动化三年多,用 AI 辅助约半年。他先举了一个反例:同事用 AI 四秒生成的 Playwright 测试跑绿了,但什么断言都没有,只点了按钮、等了三秒、确认页面还在。他认为 AI 真正值钱的地方有三处:把自然语言的 bug 报告变成会失败的测试用例、解释别人写的 flaky 测试、为混乱的 DOM 推荐更稳定的定位器;而它写不出的是判断什么重要,例如「支付回调重复到达两次会怎样」这类只有被深夜事故烫过才知道的边界。
🔑 核心要点
AI 最大的价值是把 bug 报告转成测试用例:脚手架、fixture、导航步骤能省掉约六成打字量,断言仍需人工重写。