最近在用Cursor+Claude写一个内部工具,项目到中期复杂度上来了。发现AI生成的代码经常是“看起来对”,但一跑就出边界问题,比如并发场景下的状态同步、异常处理路径缺失。我每次都要手动补很多测试用例,有时候改它的代码比我自己写还费时间。想问问各位,平时怎么平衡AI产出和人工review的?有没有什么prompt技巧能让它少犯低级错误?或者干脆哪些模块你们是坚决不交给AI的?