Prompt Engineering实测:四版指令调优百度ERNIE 4.0抽取F1值提升22%
同一份千行合同文本,用默认Prompt跑百度ERNIE 4.0(2024年3月版),实体抽取F1值只有0.63,token消耗却高达4821。经过四轮指令重构——加入角色约束、输出Schema、否定指令和示例驱动后,F1飙到0.85,token直降37%。本文用真实业务场景(企业采购合同关键条款抽取)记录完整的Prompt实验日志,包含每版Prompt的完整代码、API参数配置、失败案例分析,以及

主要整理产品设计与管理相关的学习笔记与工程经验,内容覆盖产品增长与运营、用户体验优化。关注技术选择背后的成本与边界,希望把复杂问题讲清楚、把实践步骤写完整。