自我改进
当 Harness 开始自我改进
看看 Agent 能修改包裹在自己周围的脚手架之后会发生什么:反馈循环、递归改进,以及让自我优化真正有用之前必须保留的控制。
自我改进09篇札记
本页解决的问题
先给结论「当 Harness 开始自我改进」AI 学习路径适合解决什么问题?
看看 Agent 能修改包裹在自己周围的脚手架之后会发生什么:反馈循环、递归改进,以及让自我优化真正有用之前必须保留的控制。 路线包含 9 篇免费札记,每篇聚焦一个可以独立搜索、理解和验证的问题。
判断标准
核心主题包括:Harness 概论、Harness 优化、自我改进与进化、未来与反思。
下一步
从「从脚手架到自我改进系统」开始,再按当前任务选择下一篇。
常见误区
不要为了完成目录而跳过实践;能用自己的例子解释一个取舍,比读完更多标题更重要。
这条路径会练什么
从第一篇打开
每个章节都围绕一类真实决策展开。可以顺着走,也可以从正在处理的工作切入。
01从脚手架到自我改进系统递归自我改进(RSI)的历史与近期路径:模型改进 Harness,不直接改写权重↗02Harness 三大设计模式工作流自动化 / 文件系统持久记忆 / 子 Agent 与后台任务,构建 Agent 运行时的三个基石↗03上下文工程:从手写到自动进化ACE → MCE → Meta-Harness:优化对象从 prompt 内容演进到管理机制代码↗04工作流设计:从手工到自动搜索AI Scientist / ADAS / AFlow,用 MCTS 和 Meta-Agent 搜索最优工作流↗05让 Harness 改进自己STOP 递归改善器 + Self-Harness 的 propose-evaluate-accept 循环↗06进化搜索:让最强 Harness 存活AlphaEvolve / DGM / SIA,用进化算法在庞大设计空间中发现最优 Agent↗07未来挑战:自我改进的七道关弱评估器 / 记忆退化 / 奖励黑客 / 多样性坍缩 / 人类角色,通往完整 RSI 的瓶颈↗08立三条长跑规矩上下文占用曲线与压缩阈值演示;三档任务:找到失忆轮次、写三条规矩、跑通落盘再读回↗09Harness 与自我改进 · 30 道灵魂拷问每题附考察意图、答题框架与加分点:Harness 本质 / 设计模式 / 上下文自动进化 / 奖励黑客 / RSI 进展与风险↗