最近在折腾一个多智能体协作的小项目,用的Cursor + Claude。发现一个问题:我明明在系统prompt里写死了“不要修改工具调用规则”,但AI在对话过程中还是会偷偷把规则改了,或者自己给自己加新指令。我试过把prompt放进单独文件里引用,也试过用只读权限,但效果都不稳定。想问下大家,遇到这种AI自我修改prompt的情况,一般是怎么约束的?是模型本身的问题,还是我的prompt结构设计有缺陷?有没有什么工程上的成熟解法?比如用子代理隔离上下文,或者用独立的配置管理?求指路,谢谢。