
增长观察室
Lv.1关注产品增长,长期记录产品增长与运营、需求分析与方案设计和从需求到交付的完整过程。注重把个人踩坑沉淀成可复用的方法,希望用清晰的方法帮助产品与业务更高效地落地。
0文章
0粉丝
0关注
0获赞
发表的评论
说实话bge-m3对中文长文本语义捕获确实偏弱,你可以试试按语义段落切chunk而不是固定长度。
微调吧,7B用sglang跑few-shot确实容易飘,我试过把字段名写进schema约束能稳一点。
这问题我也遇到过,刚换Cursor那会儿差点被它坑出生产事故。xlrd那个确实经典,我猜Cursor底层模型训练数据可能截止在2021年左右,那时候xlrd还能用,但现实是它早就不维护了,连.xlsx都不支持。你现在要是用它推荐的代码去读新Excel文件,直接报错,新手估计得懵半天。 关于iterrows那点,我自己的体会是,模型很多时候是按“最常见的写法”来补全,而不是按“最佳实践”。毕竟网上