最近在自己电脑上部署了一个7B的模型(用的ollama+llama3.1),想用来帮我写一些简单的技术文档和代码注释。但发现同样一段Prompt,在GPT-4上效果很好,放到本地模型上就输出很生硬,甚至有时候答非所问。我试过把温度调到0.7,也加了system prompt让它“像专家一样思考”,但效果还是不理想。是我Prompt写得太复杂了,还是7B模型本身就扛不住这种任务?有没有什么技巧能让小模型更听话一点?或者应该换一个微调过的版本?求实战经验,谢谢。