导语
自2025年末智能体开始真正“可用”以来,AI界一直在探寻其突破的原因。本文作者Dan McAteer提出,这并非单一模型能力的跃升,而是模型与包裹它的“框架”(Agent Harness)协同演进的结果。框架从最初笨拙的外部工具,逐渐被模型吸收其能力,最终将演变为一个管理人类稀缺注意力的“注意力接口”。这一演变历程,揭示了AI智能体未来发展的核心逻辑。
文章探讨了AI智能体框架(Harness)的演变,指出其从外部包裹模型的工具,逐渐被模型吸收能力,并最终演变为管理人类注意力的接口。作者认为,随着模型能力增强,未来框架的核心将是协调稀缺的人类注意力资源,而非约束模型本身。
自2025年末智能体开始真正“可用”以来,AI界一直在探寻其突破的原因。本文作者Dan McAteer提出,这并非单一模型能力的跃升,而是模型与包裹它的“框架”(Agent Harness)协同演进的结果。框架从最初笨拙的外部工具,逐渐被模型吸收其能力,最终将演变为一个管理人类稀缺注意力的“注意力接口”。这一演变历程,揭示了AI智能体未来发展的核心逻辑。
展开「深读」看每一段讨论的问题与论据。
讨论的问题:是什么导致AI代理在2025年圣诞前后开始有效工作?
论据 / 案例:引用了Transformer发明者Lukasz Kaiser在“Unsupervised Learning”播客(2025年6月)中的评论,描述了那个难以归因的“大跃进”。
讨论的问题:什么是代理封装?它的核心作用是什么?
论据 / 案例:用“给模型的大脑一个身体”的比喻来解释封装的必要性。
讨论的问题:代理封装的早期演变经历了哪些关键阶段和策略转变?
论据 / 案例:提及Answer.AI对Devin的测试显示其约15%的成功率;Claude Code在六个月内达到约10亿美元的年化收入(ARR)。
讨论的问题:当前阶段,模型与封装的关系发生了什么根本性变化?
论据 / 案例:OpenAI在ARC-AGI-3上仅通过增加“保留推理和压缩”封装,使GPT-5.6 Sol的得分从13.3%三倍增至38.3%;Anthropic团队最近删除了Claude Code 80%的系统提示。
讨论的问题:当模型持续吸收封装能力后,代理封装的最终形态会是什么?
论据 / 案例:引用了Latent Space播客中Ryan Lopopolo的观点:“唯一根本稀缺的东西是团队同步的人类注意力”;预测一年内,每家构建代理AI的公司都会发布类似AGENTS.md的“人类注意力策略文件”。
=== SUGGEST 无