AI效率与游戏PM · 2026/07/17
【加更】别让干活的AI自己验收任务
一个全AI小游戏项目的两次验收翻车:自动测试全过但运行时穿模;执行AI和审查AI都守标准,产物却偏离最初愿景。三条原则:动工前写标准、量化检查给AI、体验判断留给人。
在小宇宙收听原节目复盘一个全AI小游戏项目中的两次验收翻车:第一次,AI的自动测试全部通过,但真实运行时出现明显穿模;第二次,执行AI与审查AI都严格遵守标准,最终产物仍然偏离了最初的游戏愿景。问题从「AI会不会谎报完成」进一步转向「验收标准本身是否正确」。本期给出三条可落地原则:动工前写标准并检查文档冲突、把可量化检查交给AI、把体验与观感判断留给人。
本期讨论了这些问题
- 为什么AI的「测试全部通过」不能直接当成验收结果?
- 让另一个AI审查执行AI,能够解决哪些质量问题?
- 为什么多智能体流程完整,最终产物仍可能完全跑偏?
- 游戏PM应该怎样给AI编写可验证的验收标准?
- AI普及以后,游戏项目管理中哪些能力会变得更值钱?
要点与金句
- AI的自我汇报只能作为线索,不能作为验收结论
- 测试全过但玩家看到穿模:标准没覆盖到真实体验
- 执行和审查都守标准还跑偏:是标准本身错了
- 动工前写标准,并检查文档之间的冲突
- 可量化的交给AI,体验与观感的判断留给人
想学会给AI定验收标准,可以看《游戏PM的AI实战手册》。
想听完整的翻车复盘,可以前往小宇宙收听本期节目。