四种模型全部失败了,没有一个能让自改进Agent成功优化自身提示词。 开发者在系列实验中记录到,Agent重写提示的尝试要么被安全门直接拒绝,要么产生的编辑无法带来净收益,这与此前9个看似正常实则带bug的系统、以及安全门拒绝4150次编辑的发现一脉相承。 四模型在提示重写任务上的具……

阅读全文