过去一年,编程 Agent 的能力大幅提升,软件工程师对它们的要求也比以往任何时候都高,但上下文窗口的大小却基本停滞不前——一年前,一百万个 token 大致就是最先进的水平,如今依然如此。
随着我们逐渐进入 Agent 日常处理 Monorepo(单体仓库)级任务的世界,将越来越多的信息塞进模型那固定的上下文限制中,这种需求已经变成了一项实实在在的全职工程任务。
Daisy Hollman,这位曾在 C++ 标准委员会深耕近十年、当过两年主席的资深工程师,如今在 Anthropic 的 Claude Code 团队主导插件与 Agent 团队的设计。
近日,她在 NDC Copenhagen 的演讲中,详细介绍了 Claude Code 插件的设计与其构成的上下文工程原语,以及 Anthropic 内部是如何运作多 Agent 工作流的。
基于该演讲视频,InfoQ 对内容进行了整理。
核心观点如下: 如果 Claude 不能做所有你能做的事,它就无法和你一起做你的工作。
给 Claude 或者给你的模型,访问你完成工作所需信息的权限,会帮助它更好地做你的工作,或者和你一起做你的工作。
我们并不是真的要取代自己,我们是想要成倍地放大自己。
定制化就是知识,定制化是在弥合模型天生所知与你们团队所知之间的差距。
钩子是唯一真正能扩展的插件抽象,不匹配就不注入,只在触发时才往上下文里放东西。
2026 年的核心转变是,从“把信息输入模型”转向“把信息从模型输出给用户”,人的注意力才是系统中最小的盒子。
从聊天机器人到 Agent 最初让大语言模型跑起来的时候,我们用它们构建的是聊天机器人,交互方式大致是:人类说一句,模型回应一句,然后又回到人类说话,模型再回应,就这样循环往复。
🔗 原始来源
如果你要核对细节,可以再看原文: InfoQ AI原文链接
AI热榜