[控场AI]
· 7 分钟阅读· 3,866 字

Claude Code 新增 Mods 与 AGENTS.md 支持:深度解析

Claude Code 新增 Mods 与 AGENTS.md 支持:深度解析

Claude Code 通过 AGENTS.md 兼容与 Mods 插件机制,开放了以代码定制 AI 编码助手行为的底层能力。

Anthropic 在约一个月内为 Claude Code 推出了一批面向定制化的底层更新。其中 AGENTS.md 支持解决了跨 Coding Agent 的规则复用问题,让不同工具可以共享同一份项目说明;而 Mods 机制则更具战略意义——它基于 Function Hooks,允许开发者在上下文拼接、工具调用、界面展示等环节注入自定义逻辑,AGENTS.md 支持本身就是其首个内置 Mod 的实例。此外,Projects Beta 版聚焦多 Agent 并行协调,桌面端新增后台操作与 Session 恢复能力,Sonnet 4.5 将上下文窗口扩展至 100 万 Token,配套的 Skills Doctor 和 Plugin Eval 工具则帮助开发者量化定制成本与收益。整体来看,这轮更新的核心指向是:让 Claude Code 从单一工具演进为可编程的 AI 工作流平台。

Anthropic 在近期的一系列版本迭代中,为 Claude Code 悄悄铺开了一套面向定制化的底层能力。这次更新覆盖了从 AGENTS.md 兼容支持、Mods 插件机制,到 Projects 重设计、后台电脑使用等多个方向。据 B 站 UP 主的梳理,这些内容集中在约一个月的更新窗口内陆续上线,其中最值得关注的并非某个单一功能,而是背后 Mods 机制所指向的方向——让开发者用代码去定制 Claude Code 的行为。

AGENTS.md 支持:解决跨 Agent 的兼容痛点

Claude Code 现在能够直接读取项目里的 AGENTS.md 文件。这个文件通常用来告诉编码 Agent 该如何工作:怎么跑测试、该用哪个包管理器、哪些文件夹里是生成文件等。该功能随 2.1.277 版本上线。

默认逻辑是这样的:如果项目没有自己的 Claude 专属说明文件(如 CLAUDE.md),Claude Code 就会使用 AGENTS.md;如果项目里已有 CLAUDE.md,则后者优先生效。你也可以在 Configure Project Instructions 里修改这一设置,甚至选择同时加载两个文件——把共享的项目指导和 Claude 专属指令放在一起。

这个设计的实际价值在于减少重复维护。当你在同一项目里切换不同的 Coding Agent 时,共享一份规则就不必维护多个重复副本。需要留意的限制是:发布时该支持还不能用在 Bedrock、Vertex 或 Foundry 上。

一个务实的建议是把共享文件写得简洁,只放代理真正需要的命令和规范,再单独检查执行结果——因为「能读文件」不代表「每条指令都会被完美执行」。

不代表每条指令都会被完美执行

Mods:真正值得关注的底层机制

如果说 AGENTS.md 是一个立竿见影的兼容性改进,那么 Mods 才是这次更新里更具想象空间的部分。

这里需要先理解 Harness 的概念——它指的是模型周围的软件层,负责处理上下文拼接、调用工具以及展示会话。Anthropic 把 Mods 定义为「一个使用 Function Hooks 的插件」,让开发者可以用代码接入并改变这些行为。

Anthropic 的早期演示包括修改界面组件,以及在模型接收工具输出之前先做过滤。这也解释了为什么 AGENTS.md 支持会成为一个很好的第一个例子:它本质上就是一个内置 Mod,负责决定哪些项目说明会被传给模型。文档提到,开发者以后可以自己构建这种指令加载行为的版本。

目前公开仓库里已经有四个内置 Mods:Agent 预加载器、Diff 面板、Telemetry,以及一个组织安全 Mod。想自定义 Mod 的开发者需要先启用 Function Host,且 API 可能在不同版本之间变化。换句话说,内置能力已经上线,但更大的自定义系统仍在开发中。

对做专门编程工作流的团队而言,这个方向尤其值得关注。一个理想的应用场景是:让 Mod 为大型项目的每一部分自动整理出合适的指令,而不必把每个团队的规则都塞进每一个任务的上下文里。

Diff Mod

Diff 面板:实时可见的编辑反馈

Diff Mod 对应的是 2.1.260 版本里的一个实用更新。在全屏模式下,聊天旁会多出一个实时面板,展示 Claude 编辑或运行命令时的文件修改和行数变化,且实时更新。你还能选中某些行附加到下一条消息。

使用条件是需要一个 Git 仓库,以及一个至少 110 列宽的终端。这样当 Claude 改错某个函数时,你可以直接指出具体改动、说明需要调整的地方,同时对话保持可见。

Function Hooks 是一种软件设计模式,允许外部代码在系统执行流程的特定节点"钩入"并改变默认行为,无需修改核心代码本身。在 Claude Code 的语境里,这意味着开发者可以在「用户输入→模型处理→工具调用→结果展示」这条链路的各个环节注入自定义逻辑——例如在工具调用结果返回给模型之前先做过滤、脱敏或格式转换。这与浏览器扩展、Webpack 插件、Git Hooks 等开发者熟悉的机制在设计思想上高度一致:核心系统暴露出扩展点,生态由第三方填充。Mods 机制将这套思路引入 AI 编码助手领域,使得企业可以在不 fork 整个工具链的前提下,为自己的团队定制安全策略、上下文管理或界面行为。

Projects 重设计与后台电脑使用

Projects 推出了重新设计的 Beta 版,一开始只向部分 Pro 和 Max 订阅用户开放,使用 Claude Sessions,且这些用户暂时还不能在 Web 或 Desktop 上用 Projects。并行线程会更快消耗额度。

Projects 的核心价值在于协调多个 Agent 同时工作。比如给它一个「既要改 API 又要更新前端」的功能需求,如何处理好各 Agent 之间的交接,将是决定其可用性的关键。

在已批准的应用里工作

桌面端方面,后台电脑使用功能已经上线。在 macOS 15 或更高版本上,Claude 可以在你继续使用电脑的同时,在已批准的应用里工作,对 Pro 和 Max 订阅用户仍是 Beta 版。它对那些只能在原生应用里操作、又没有命令行界面的任务特别有用。使用时需要批准 Claude 可访问的应用,桌面端应用必须保持运行,并且要让电脑保持唤醒。

另一个桌面改进是可以在 App 里用 /resume 继续一个从 Terminal 开始的 Session,Conversation 和 Context 都会完整保留。

Claude Sessions 是 Claude Code 中用于管理对话状态和上下文的持久化单元。与普通的无状态 API 调用不同,Session 会在多次交互之间保留上下文、工具调用历史和中间状态,使得跨步骤的长任务得以连贯执行。Projects 依赖 Sessions 来协调多个并行 Agent——每个 Agent 拥有独立的 Session,同时共享项目级别的上下文配置。值得注意的是,Session 本身也会占用 Token 配额:保留的上下文越长,每次调用的成本越高。这也是为什么文章中提到「并行线程会更快消耗额度」——多个 Session 并行意味着多份上下文同时计费,而非单一长对话的线性增长。

模型更新与效果评估工具

模型层面,Sonnet 4.5(视频中读音有偏差)已发布,Claude Code 从 2.1.257 版本起支持,上下文窗口达到 100 万 Token。普通设置里会自动选择新模型,但 Gateway 存在例外——其 Alias 仍指向旧版本,需要手动指定名称。切换前建议确认自己的 Access 和 Usage 要求,根据不同 Plan,可能会单独计入 Usage Credits。

帮你找出哪些可以考虑禁用

配合这些自定义能力,还有两个评估工具很值得一提:

  • Skills Doctor:显示 Skills 的上下文成本和使用情况,帮你找出哪些可以禁用。这一点很重要,因为即使 Skills 没有被调用,仅仅「列出可用」也会占用上下文。
  • Plugin Eval(2.1.269 版本):你可以提供测试用例和评分检查,让它用你的插件跑一遍,默认还会再跑一遍不带插件的对比。由于这是真实的模型调用,会消耗 Usage。

实操建议是:在给配置增加复杂工作流之前,先挑几个你经常重复的任务、定义好「什么叫好结果」,再看插件带来的提升是否足以抵消额外成本。

Skills(技能)在 Claude Code 中指的是预配置的工具或能力模块,例如代码搜索、文件读写、终端命令执行等。Skills Doctor 之所以值得重视,源于一个反直觉的机制:即便某个 Skill 在当前任务中从未被实际调用,仅仅是将其列入「可用工具清单」这一步骤本身,就会以 Tool Definition 的形式占据上下文窗口的 Token 空间。工具定义越复杂、数量越多,每次请求的基础成本就越高,且压缩了留给实际代码和对话的空间。Skills Doctor 提供的用量可视化,本质上是帮助开发者识别「名义上开启但实际上从不触发」的 Skill,通过裁剪工具列表来降低每次调用的隐性开销。

小结

这一轮更新里,Mods 和 AGENTS.md 是最具信号意义的部分。前者给出了「修改 Harness 会带来什么效果」的具体范例,后者则解决了一个立刻存在的跨 Agent 兼容性问题。随着自定义接口逐步稳定,社区能在此基础上做出什么,才是更值得期待的看点。对于日常高频使用 Claude Code 的开发者,不妨结合自身工作流思考:你更需要用 Mods 做深度定制,还是让 Projects 帮你协调多任务。

分享:

相关推荐