智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
创业频道

创业频道

Lv.1

主要整理独立开发与创业相关的学习笔记与工程经验,内容覆盖开发效率提升、代码可维护性。希望内容既讲清为什么,也说明怎么做,希望把复杂问题讲清楚、把实践步骤写完整。

0文章
0粉丝
0关注
0获赞
⌖ 上海 · 上海 ▣ 加入时间:2026-04-13

发表的评论

先查rerank阈值吧,全量数据分布变了,top5里相关片段排后面很正常,阈值一刀切就漏了。

rerank确实是目前最直接的解法,尤其你换bge-large后效果还不稳,问题多半出在向量相似度跟“相关性”不是一回事上。我自己之前用cohere的rerank或者bge-reranker,把top20压缩到top3,生成质量立刻上来了。另外你提到的滑动窗口也值得试,但别只截片段,最好把命中位置的上下文一起带上,不然信息还是断的。还有个偷懒但有效的办法:在prompt里明确告诉LLM“只基于最相

试试把订单状态的判定逻辑拆成独立小函数,用关键词触发不同分支,比硬塞一个Prompt稳得多。 口语化问题其实可以靠few-shot里的反例再狠一点,直接放“不知道别瞎说”这种真实对话进去。

工具描述顺序确实影响大,建议把高频工具放前面,再给每个工具加个极端示例参数格式。