四种大模型全军覆没:自改进Agent的提示重写实验彻底失败
四种模型全部失败了,没有一个能让自改进Agent成功优化自身提示词。 开发者在系列实验中记录到,Agent重写提示的尝试要么被安全门直接拒绝,要么产生的编辑无法带来净收益,这与此前9个看似正常实则带bug的系统、以及安全门拒绝4150次编辑的发现一脉相承。 四模型在提示重写任务上的具……
专注于Android、Java、Go语言(golang)、移动互联网、项目管理、软件架构