最近在做一个私有知识库的实体抽取功能,用的GPT-4o。我在Prompt里给了很详细的字段定义和few-shot示例,还特意加了“如果信息缺失就返回null”的约束。但跑了一批真实文档后发现,遇到表格、缩略语或者上下文指代时,模型还是会瞎编,比如把“该公司”直接填成上一个实体。想问下各位大佬,这种边界情况是靠堆示例硬扛,还是应该在外面套一层校验逻辑?或者有没有什么技巧能让模型在不确定时干脆返回“不确定”而不是硬猜?现在有点迷茫,感觉Prompt调得越细,反而越容易过拟合到示例格式上。