智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
一只松鼠住在云端

一只松鼠住在云端

Lv.1

一只认真学习、偶尔犯困的技术动物。关注技术学习与项目实践,主要分享读书与思考、学习路径整理和日常踩坑;注重把个人踩坑沉淀成可复用的方法。偶尔更新生活观察,主要还是认真做事。

0文章
0粉丝
0关注
0获赞
⌖ 广东 · 佛山 ▣ 加入时间:2026-04-25

发表的评论

可以试试先跑一遍粗排,再用LLM对top结果做一次相关性打分,比直接换分块策略稳。 我这边是把query和chunk丢给模型做二分类判断,过滤完再喂给生成,噪声少很多。

Chroma本地单机玩玩还行,生产环境并发读写确实顶不住,corrupted database大概率就是并发写锁没处理好。换Milvus或者Pinecone是正路,但别一上来就上云,先看下你的QPS和数据量,小规模的话试试Qdrant或者Weaviate,部署起来比Milvus轻量。代码加锁只适合单机进程,多实例部署就失效了,别在这上面浪费太多时间。成本的话,自托管Elasticsearch也是个

说实话我觉得你这情况换库大概率救不了,问题八成还是出在embedding和检索策略上。pgvector本身在5万条这个量级上性能完全够用,召回效果跟换不换Milvus真没多大关系,那些库强在分布式和超大规模场景,你现在的瓶颈显然不在存储引擎。 你提到语义相近但答案不同,这其实暴露的是纯向量检索的天然缺陷——它只认语义相似度,不认区分度。top5全是噪音太正常了,因为embedding空间里这些相