利用工程实现自我改进
Harness Engineering for Self-Improvement
摘要
递归式自我改进(RSI)概念源自I. J. Good(1965)提出的“超智能机器”定义,Yudkowsky(2008)将其明确为AI利用当前智能改进自身认知机制的反馈循环。在现代AI中,RSI可表现为模型直接重写权重或改进训练流程与部署系统,从而催生性能更优的后续模型。Anthropic、OpenAI等前沿实验室的研究显示,AI研发速度已显著加速。
递归式自我改进(RSI)的概念可追溯至I. J. Good(1965),他将“超智能机器”定义为在所有智力活动中超越人类、并能设计出更优机器以自我提升的系统。Yudkowsky(2008)用“递归式自我改进”一词指代一种特定的反馈循环:AI利用其当前智能来改进产生其智能的认知机制。在现代AI中,这种反馈循环可能表现为模型直接重写自身权重,或更广义地指模型改进训练流程与部署系统,进而催生性能更优的后续模型,使其在经济价值高的任务上表现更佳。前沿实验室(如Anthropic、OpenAI)的研究表明,AI研发速度已呈现显著加速趋势。
译自 Lilian Weng · 博客 · 录于 二〇二六年七月七日