修改
分类
自己
但问题也随之而来:如果一个Agent一轮又一轮地根据同一批任务修改自己,它到底是在“进化”,还是只是在越来越会做这套题?
文章
过去谈RSI,我们很容易想到一个颇具未来感的场景:AI修改自己的模型,再用更强的自己继续改进下一代系统。
文章
模型外围
冻结模型权重,Agent还能持续进化:ModularRSI探索Harness自我改进2026年09月24日12:56机器之心Pro近日,IQuestResearch同北京航空航天大学、曼彻斯特大学等合作伙伴发布ModularRSI,尝试让Agent根据自身执行经验,持续修改模型外围的运行机制——Harness。
文章
修改
当然,《专利审查指南》此次对“同日双申”制度的修改是在现行专利法及其实施细则制度框架下的有限调整,更根本的制度变革尚有待来日。
文章
代码
一次任务执行结束后,ModularRSI不会根据单条失败轨迹立即修改代码。
文章
如果一个Agent反复在同一类任务上执行,并不断针对失败修改代码,它很容易逐渐熟悉特定benchmark的任务结构、工具约定和常见失败模式。
文章
效果
同时,它会保留完整的EvolutionHistory:过去哪个hypothesis成功过、哪个机制已经失败过、某次修改增加了多少score、付出了多少cost,都会继续成为下一轮Search的evidence。
文章