自我改进 · 当 Harness 开始自我改进

从脚手架到自我改进系统

递归自我改进(RSI)的历史与近期路径:模型改进 Harness,不直接改写权重

本页解决的问题

先给结论

「从脚手架到自我改进系统」要解决的关键问题是什么?

递归自我改进(RSI)的历史与近期路径:模型改进 Harness,不直接改写权重

判断标准

让这个结论先证明自己值得留下。 把这一页当成决策工具,而不是需要背下来的定义。把概念连到一个真实任务、一个可观察结果,以及一个能改变你判断的失败上。

下一步

写下一个问题:试完这个方法后,你能用什么证据回答它?

常见误区

结论听起来很完整,却没有检查最关键的假设。

Recursive Self-Improvement

一个系统,能用自己当前的智能去改善产生智能的机制本身

I. J. Good(1965)定义了「超级智能机器」:能在所有智力活动上超越人类,并设计更好的机器来改进自身。Yudkowsky(2008)将此概括为「递归自我改进」(RSI)。
Lilian Weng
本篇章的全部思路,来自 Lilian Weng 的这篇博客
自我改进篇的整个框架、概念与案例,都源自 Lilian Weng 于 2026 年 7 月发表的长文《Harness Engineering for Self-Improvement》。我在这里做的只是把它讲得更适合课堂,观点与功劳都属于原作者。

她是一位令人尊敬的前辈,多年来在 AI 安全与 Agent 前沿领域持续输出,她的博客几乎是这个行业公认的必读。非常推荐关注她的推特,也强烈建议你读完这一章后回去读原文。
RSI 的演进
1965 · Good
"Ultra-intelligent machine":能设计更好机器的机器。理论设想。
2008 · Yudkowsky
正式提出 "Recursive Self-Improvement":AI 用自身智能改进产生智能的认知机制。
2023–2024
Self-play、合成数据、Test-time training 等早期尝试。模型开始改善自己的训练数据。
2025–2026
Harness 工程成为 RSI 的核心路径:模型不直接改写权重,它改进的是围绕自身的部署系统、工作流和上下文管理。
什么是 Harness?
Harness = 模型周围的一切编排系统
Harness 是围绕基座模型的运行时系统,决定模型如何:

思考与规划 · 调用工具与行动 · 感知与管理上下文 · 存储制品 · 评估结果

成功的 AI 产品(如 Claude Code、Codex、Cursor)已经证明:Harness 层与原始模型智能同等重要。一个平庸的模型加上优秀的 Harness,往往胜过裸露的更强模型。
Codex Agent Loop
一个简化的 Codex Agent 循环:Agent 调用工具,工具返回影响下一轮生成。(来源:OpenAI)
为什么 Harness 是近期 RSI 的实际路径?
近期 RSI 的三步预测
1. 模型不会直接改写自己的权重,但它能改进训练管线和部署系统,使下一代模型更强。

2. Harness 工程走向元方法论:改善的对象从答案本身,变成得到更好答案的机制。Harness 本身成为优化目标。

3. 成熟 Harness + 智能模型 = 正反馈循环:更好的 Harness 催生更强模型,更强模型又让 Harness 不必过度工程化。
与 Prompt Engineering 的类比
我们已经见过更软的版本:随着指令微调和推理能力提升,手动 Prompt 技巧变得不那么核心了,但指定目标、约束、上下文和评估的需求并没有消失。

同理,最终很多 Harness 改进会被内化为模型行为,但与外部上下文和工具的接口将永远存在。
核心观点:递归自我改进不需要从模型直接修改权重开始。更现实的路径是让模型改进围绕它的 Harness 系统(上下文管理、工作流、工具编排、评估),形成持续改进的飞轮。这就是 Harness Engineering for Self-Improvement 的核心论点。

「一个系统,能用自己当前的智能去改善产生智能的机制本身」里的算法代价曲线

「递归自我改进(RSI)的历史与近期路径:模型改进 Harness,不直接改写权重」真正训练的不是背诵步骤,而是识别重复工作:输入变大时,程序到底多做了多少次比较、移动或递归。

先找重复工作,再谈快慢

「递归自我改进(RSI)的历史与近期路径:模型改进 Harness,不直接改写权重」可以拆成输入规模、每轮做什么、以及是否能缩小下一轮范围三个问题。Big-O 是描述增长趋势的语言,不是对每台机器的精确计时;常数、内存和真实数据分布也会影响最终结果。

别把理论最优当成无条件最优

面对 AI 写出的算法,先用小输入手算一遍,再用逐渐放大的数据做基准测试。这样才能把「递归自我改进(RSI)的历史与近期路径:模型改进 Harness,不直接改写权重」从一句结论变成可检查的性能判断。

从「一个系统,能用自己当前的智能去改善产生智能的机制本身」走到「RSI 的演进」

「一个系统,能用自己当前的智能去改善产生智能的机制本身」先把问题落在「I. J. Good(1965)定义了「超级智能机器」:能在所有智力活动上超越人类,并设计更好的机器来改进自身。Yudkowsky(2008)将此概括为「递归自我改进」(RSI)。 本篇章的全部思路,来自 Lilian Weng 的这篇博客 自我改进篇的整个框架、概念与案例,都源自 Lilian Weng 于 2026 年 7 月发表的长文《Harness Engineering for Self-Improveme…」上;到了「RSI 的演进」,讨论继续推进到「1965 · Good "Ultra-intelligent machine":能设计更好机器的机器。理论设想。 2008 · Yudkowsky 正式提出 "Recursive Self-Improvement":AI 用自身智能改进产生智能的认知机制。 2023–2024 Self-play、合成数据、Test-time training 等早期尝试。模型开始改善自己的训练数据。 2025–2026 Harnes…」。两段连起来,重点就不只是记住一个结论,而是看清它成立所依赖的条件。

把这条判断带到下一个场景

算法题换成真实任务后,先找出重复工作,再问输入规模如何变化,最后用一个小基准验证理论判断。这样不会把复杂度记成脱离场景的标签。

  • 「一个系统,能用自己当前的智能去改善产生智能的机制本身」:I. J. Good(1965)定义了「超级智能机器」:能在所有智力活动上超越人类,并设计更好的机器来改进自身。Yudkowsky(2008)将此概括为「递归自我改进」(RSI)。 本篇章的全部思路,来自 Lilian Weng 的这篇博客 自我改进篇的整个框架、概念与案例,都源自 Lilian Weng 于 2026 年 7 月发表的长文《Harness Engineering for Self-Improveme…
  • 「RSI 的演进」:1965 · Good "Ultra-intelligent machine":能设计更好机器的机器。理论设想。 2008 · Yudkowsky 正式提出 "Recursive Self-Improvement":AI 用自身智能改进产生智能的认知机制。 2023–2024 Self-play、合成数据、Test-time training 等早期尝试。模型开始改善自己的训练数据。 2025–2026 Harnes…
  • 「为什么 Harness 是近期 RSI 的实际路径」:近期 RSI 的三步预测 1. 模型不会直接改写自己的权重 ,但它能改进训练管线和部署系统,使下一代模型更强。 2. Harness 工程走向元方法论 :改善的对象从答案本身,变成得到更好答案的机制。Harness 本身成为优化目标。 3. 成熟 Harness + 智能模型 = 正反馈循环 :更好的 Harness 催生更强模型,更强模型又让 Harness 不必过度工程化。 与 Prompt Engineerin…

最后的「为什么 Harness 是近期 RSI 的实际路径」把讨论落到「近期 RSI 的三步预测 1. 模型不会直接改写自己的权重 ,但它能改进训练管线和部署系统,使下一代模型更强。 2. Harness 工程走向元方法论 :改善的对象从答案本身,变成得到更好答案的机制。Harness 本身成为优化目标。 3. 成熟 Harness + 智能模型 = 正反馈循环 :更好的 Harness 催生更强模型,更强模型又让 Harness 不必过度工程化。 与 Prompt Engineerin…」。回看这条线索时,最值得保留的是:当输入、规模或风险改变,哪些判断需要重新做一遍。

标记为已学完 阅读进度会自动记录
← 上一篇下一篇 →

继续阅读

同一条线上的下一篇。

文章讨论

读到这里,留下一个判断。

把刚想明白的地方、还没想通的问题,留给下一位一起学习的人。

正在讨论 从脚手架到自我改进系统 当 Harness 开始自我改进
3条讨论文章讨论 · 与共学社区同步
在共学社区查看
AM
Asha Morgan内容编辑
观点实践记录

我把这篇文章里的一个判断改写成了今天可以验证的小实验。比记住结论更有用的是,知道下一步要观察什么。

文章讨论7 有帮助
LH
Lin Harper独立开发者
观点观点

读完以后我先回头找它成立的条件,而不是直接把方法搬进项目。这个顺序让后面的取舍清楚很多。

文章讨论5 有帮助
KM
Kiki Moore产品运营
问题问题

如果把这个判断放到真实工作里,最先需要补的约束是什么?我想知道从阅读到第一次实践之间,哪一步最值得先做。

文章讨论4 有帮助