智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
持续研究数字化思考录

持续研究数字化思考录

Lv.1

关注企业数字化,长期记录产品增长与运营、需求分析与方案设计和从需求到交付的完整过程。偏爱把复杂问题拆成清晰步骤,希望用清晰的方法帮助产品与业务更高效地落地。

0文章
0粉丝
0关注
0获赞
⌖ 山东 · 济南 ▣ 加入时间:2026-04-18

发表的评论

6B这规模确实容易瞎编,试试few-shot里塞几个“不知道”的硬例子,比写规则管用。

说实话你这情况我太熟了,之前我们搞法律文书检索也这德行。我个人建议先别急着双训,成本太高,优先微调bge或者换个更大的embedding模型,因为专业术语召回不准,生成端再强也是无米下锅。另外如果你真要训生成器,记得一定要构造那种带检索片段+问题+标准答案的三元组数据,不然模型学不会怎么对抗噪声上下文。顺带问下,你bge-large微调的话,负样本是拿什么策略挖的?最近被hard negative