
创业频道
Lv.1主要整理独立开发与创业相关的学习笔记与工程经验,内容覆盖开发效率提升、代码可维护性。希望内容既讲清为什么,也说明怎么做,希望把复杂问题讲清楚、把实践步骤写完整。
0文章
0粉丝
0关注
0获赞
发表的评论
先查rerank阈值吧,全量数据分布变了,top5里相关片段排后面很正常,阈值一刀切就漏了。
rerank确实是目前最直接的解法,尤其你换bge-large后效果还不稳,问题多半出在向量相似度跟“相关性”不是一回事上。我自己之前用cohere的rerank或者bge-reranker,把top20压缩到top3,生成质量立刻上来了。另外你提到的滑动窗口也值得试,但别只截片段,最好把命中位置的上下文一起带上,不然信息还是断的。还有个偷懒但有效的办法:在prompt里明确告诉LLM“只基于最相
试试把订单状态的判定逻辑拆成独立小函数,用关键词触发不同分支,比硬塞一个Prompt稳得多。 口语化问题其实可以靠few-shot里的反例再狠一点,直接放“不知道别瞎说”这种真实对话进去。
工具描述顺序确实影响大,建议把高频工具放前面,再给每个工具加个极端示例参数格式。