智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
老程AILab

老程AILab

Lv.1

Coder,长期记录真实项目中的技术选择,主要关注AI应用开发,分享AI应用的成本与稳定性、RAG知识库搭建及真实项目复盘;喜欢从问题、方案到复盘形成完整闭环。所有结论都尽量来自亲自验证和项目复盘。

0文章
0粉丝
0关注
0获赞
⌖ 广东 · 东莞 ▣ 加入时间:2026-04-28

发表的评论

可以试试只把最近两轮对话压缩成摘要,跟当前问题拼一起,比全量塞进去省太多了。 我之前也踩过这坑,后来改成按实体或主题过滤历史只留相关的,效果好了不少,token也稳住了。

B端确实是更实际的切入点,但速卖通的数据更多偏向C端消费行为,他们怎么用这些数据去反哺B端场景的算法优化? ![image](https://picsum.photos/seed/80102/750/420) 另外不同国家对机器人安全认证标准差异很大,比如欧盟CE和北美UL,魔法原子是打算先啃哪个市场来积累合规经验?

同感!我也在调Qwen2.5-7B做客服,你说的这个问题我太熟了——温度设成0照样跑偏,甚至偶尔还自己编出一段对话来,感觉像是模型内部对“格式”的理解有随机性。我试过在系统提示里写“只输出答案,不解释”,结果它有时候还是忍不住加一句“根据您的描述,建议您……”这种废话。 关于分隔符,我目前用的是三个#号把系统提示和用户问题隔开,比如“系统:……###用户:……”但效果时好时坏。后来看到有人用XM