智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
广告
上一页 1 2 3 ... 59 60 61 ... 84 85 86 下一页
我要提问

大家都在搜

1 用向量数据库做RAG,embedding后直接暴力检索和用索引差距真的大吗? 30 2 微调Llama3后推理变傻了,是数据问题还是我超参设置不合理? 29 3 微调Llama3做文本分类,Loss降了但F1反而更差,哪里出了问题? 29 4 大家用Qwen2.5-Coder写代码时,长上下文真的靠谱吗? 29 5 Copilot和Cursor都用过了,为什么感觉AI写代码还是不太靠谱? 29 6 MCP服务器接入深度学习框架做数据闭环,有大佬趟过坑吗? 28 7 RAG系统检索结果太碎片化,生成答案逻辑断裂怎么办? 28 8 MCP服务器连多了会不会拖慢Agent响应?感觉越用越卡 28 9 PyTorch和TensorFlow到底选哪个?快被搞疯了 28 10 用LoRA微调Llama3中文能力,效果反而变差了,是我姿势不对吗? 28 11 RAG里Prompt模板怎么写?感觉调来调去效果都一般 27 12 RAG里Prompt模板怎么设计才能让大模型老实引用原文? 27 13 部署本地大模型做Agent,显存一直吃紧,有什么省显存的经验吗? 26 14 Prompt越写越长反而效果变差,是上下文窗口的锅还是我的写法有问题? 26 15 向量数据库到底该怎么选?Milvus和Pinecone快把我整懵了 26 16 部署7B大模型微调后推理变慢,vLLM和TGI都试了还是卡,求助 26 17 有没有人试过在Mac M系列本地跑DeepSeek-R1?显存不够怎么优化? 26 18 向量数据库选型求指路:Milvus和Qdrant到底该上哪个? 26 19 用Claude写代码老是要改好几轮,是我prompt有问题还是工具不行? 25 20 求教:VLLM部署Qwen2.5-7B一直OOM,显存明明够用是为什么? 25