内容摘要
EXO 试图把 agent 从“可插拔”推进到“可自改写”:执行策略本身可以在运行时被安全修改、重建和回滚。Alex 认为这让真正的递归自改进开始具备工程可行性,但前提仍是隔离、评估与防 reward hacking 机制。
关键观点
EXO 的目标是完整递归自改进
Alex 对 EXO 的定义非常直接:它不是只会调用更多工具的 agent,而是能在运行时安全修改自身所有组成部分的 agent。这里的“自改进”不是外围系统替它调参,也不是人类手动加插件,而是运行中的系统自己决定如何改自己。这个命题把 agent 从工作流编排器推进为可演化的软件体。它的中心 thesis 是:如果 agent 真要持续变强,就必须能修改构成自己行为的那层代码与策略。
为什么重要: 这决定了 EXO 讨论的不是“更好用的 agent UX”,而是 agent 是否能成为长期演化的系统。若成立,能力增长将更多发生在运行时架构层,而非只能等待下一代模型发布。
支撑证据
Exo is an agent that's fully recursive. So it's able to safely edit all aspects of itself at runtime
OpenClaw 式系统证明了可扩展,但还不是完全自递归
Alex 并没有否定 OpenClaw,反而把它视为重要前驱,因为它让 agent 开始显得“会适应工作流”。但他认为这种适应仍然很窄,主要集中在 memory、skills、tools 等预留扩展点。也就是说,系统支持你往既定插槽里塞新能力,却不会主动重写“插槽为什么这么设计、上下文怎么拼、工具如何调度”这些更底层 policy。EXO 想跨过去的正是这道边界。