最近在折腾用Claude和GPT-4写一些数据处理的小脚本,发现一个很头疼的问题。我给的prompt已经很详细了,包括输入格式、输出要求、甚至示例代码。但AI生成的代码,主逻辑基本能用,一到边界条件(比如空列表、None值、超大数字)就各种报错,要么直接崩,要么结果完全不对。我试过在prompt里加“请考虑所有边界情况”,但效果时好时坏。也试过让它自己写测试用例,但覆盖还是不全。想问问各位老哥,有没有什么prompt工程上的技巧,能稳定约束模型把防御性编程做进去?还是说这本质上得靠我事后review再打补丁?有点迷茫,感觉现在调prompt像玄学。