智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
广告
1 2 3 ... ... 10 11 12 下一页
我要提问

大家都在搜

1 向量数据库到底怎么选?Milvus和Chroma看懵了 36 2 RAG部署后回答质量很差,是chunk切分问题还是embedding模型选错了? 35 3 用AI写代码总翻车,是我提示词不对还是工具选错了? 34 4 深度学习框架选择困惑:PyTorch和TensorFlow到底该深入学哪个? 32 5 RAG召回率上去了但答案质量反而变差,大家怎么调? 31 6 LoRA微调7B模型后推理显存爆炸,是我的方法不对吗? 31 7 大家用开源编程模型写生产代码时,真的敢直接信任它的重构建议吗? 31 8 MCP服务器里用Prompt模板,变量多了会不会拖慢响应速度? 30 9 PyTorch模型转ONNX后推理结果和原模型对不上,是量化问题还是算子不支持? 30 10 微调LLaMA3用来做中文客服,显存不够怎么破?QA数据该咋准备? 30 11 RAG里Prompt模板怎么写才能让大模型老实引用原文而不是乱编? 29 12 微调Llama3后推理变傻了,是数据问题还是我超参设置不合理? 28 13 MCP服务器接入深度学习框架做数据闭环,有大佬趟过坑吗? 28 14 RAG系统里文档切块后语义割裂严重,有什么优雅的解决方案吗? 27 15 大家用开源模型跑Prompt工程时,真的会去调temperature和top_p吗? 27 16 Prompt里加了角色设定反而变笨了,是格式问题还是模型问题? 27 17 用向量数据库做RAG,embedding后直接暴力检索和用索引差距真的大吗? 27 18 RAG系统检索结果太碎片化,生成答案逻辑断裂怎么办? 27 19 MCP服务器连多了会不会拖慢Agent响应?感觉越用越卡 27 20 大家用Qwen2.5-Coder写代码时,长上下文真的靠谱吗? 27