
模型一行没训练,Agent准确率却涨4.86个百分点:ModularRSI让Harness自己改代码
冻结基础模型,只让Agent从成功与失败轨迹中修改循环、工具、观测、上下文和完成判断;真正关键的不是分数上涨,而是这些改进能否跨任务、跨领域、跨模型继续成立。
ModularRSI将Agent Harness拆成五个可演化模块,在模型权重冻结时通过对比成功/失败轨迹、三…
3 000
暂无菜单项
ModularRSI模块化Agent Harness递归自我改进、论文、代码和实验结果。

冻结基础模型,只让Agent从成功与失败轨迹中修改循环、工具、观测、上下文和完成判断;真正关键的不是分数上涨,而是这些改进能否跨任务、跨领域、跨模型继续成立。
ModularRSI将Agent Harness拆成五个可演化模块,在模型权重冻结时通过对比成功/失败轨迹、三…
