跳到正文
全部 31 篇FREN中文
目录
第 4 部分 · 第 1 篇,共 8 篇 难度:进阶 阅读时间:15 分钟

搭建您的智能体

给您的智能体更多工具、把它接到您的数据上、把活分给子智能体、并框定它的权限。如何从一个默认智能体走到一个为您量身定制的智能体。

本文目录
  1. 01通过 MCP 给它更多工具
  2. 02子智能体:把活分出去,保持整洁
  3. 03框定权限
  4. 04配置与记忆
  5. 05Claude Code、Codex 与 OpenCode,并排比较
  6. 06操作步骤
  7. 07常见问题

要点速览

要让编程智能体贴合您的需要,可以调整四个杠杆:MCP 服务器为它增加工具(GitHub、数据库、浏览器),子智能体承担搜索和并行任务,权限决定它可以不经询问就做什么,记忆文件在每次会话时提醒它您的规则。先从只读开始,工具越少越好,在正式使用之前先用一个小任务测试。

请先完成: 什么是 AI 智能体(agent)?安装 agent(趁早)

现在您知道了智能体是什么:一个模型、一批工具,以及一个让它不断重来直到达成目标的循环。刚装好的 Claude Code、Codex 或 OpenCode,本身就已经是一个完全可用的智能体,文件系统、终端、git、搜索。但那是默认的智能体,所有人都一样的那个。这一篇,就是走向您的智能体:我们丰富它的工具,把它接到您的数据上,并框定它的行为,让它按您想要的方式干活。

通过 MCP 给它更多工具

最强大的杠杆叫 MCP, Model Context Protocol(模型上下文协议)。这是一个开放标准,已成为智能体与外部世界之间的通用接口。思路是:与其为每个服务写一套定制集成,您只需加上一个小程序,一个 MCP 服务器,智能体就一下子获得一把新的行动能力。

举例最能说明问题。把您的智能体接到 Postgres,它就能直接查询您的数据库:「昨天有多少订单?」,它写出查询语句并回答您。把它接到 GitHub,它就能在终端里管理您的 issue 和 pull request,无需离开。接上一个网页搜索服务器、一个文件系统访问、您的工单系统、您自己写的内部服务:每一个 MCP 服务器,都是给智能体接长的一条手臂。

Claude Code、Codex 和 OpenCode 三者都支持 MCP。具体来说,您在智能体的配置里声明一个服务器(一个名字、一条要运行的命令、有时还有一个 API key),重启,新工具就出现了。常见的服务器, filesystem、GitHub、Postgres、Slack, 都已现成做好;您什么都不用写,指向它们即可。

大家实际都在接什么

可用的服务器每个月都在变多。日常最有用的这几个:

服务器agent 能做什么
Meta Ads查看某个投放的花费、广告审核状态,暂停或重启投放
GitHub开 issue 并评论、读 pull request、跟踪 actions
Postgres、SQLite用自然语言查询您的数据库,不用自己写 SQL
浏览器(Playwright、Puppeteer)打开页面、点击、填表单、截屏
Slack、Telegram读某个话题、发消息、给您报警
文件系统在您指定的某一个目录里读写

Meta 这个服务器是很好的教材,因为它把价值和危险摆在了同一个动作里。一个 agent 查一下就能在三秒内发现某个投放已经暂停了两天,而人要看到这件事,得打开广告管理后台并且找对地方。同一个 agent 也能把这个投放重新打开,也就是花您的钱。

Claude Design:当产出不是文字的时候

agent 会产出代码、文件、消息。它也能产出视觉。

Claude Design 是 Anthropic 的设计稿工具,在 Pro、Max、Team 和 Enterprise 方案中以 beta 形式提供。它的入口是 claude.ai/design,Claude Code 也能直接调用:输入 /design 加一句需求(「/design 一个银行 App 的设置页面」),agent 就会在一块画布上作画,若干张画板并排铺开。您在浏览器里打开结果,选中一个元素、修改它,改动会自动保存。每张画板都可以导出为 PNG 或 PDF。

关键的变化就在这个交接上。以前要改 agent 产出里的一个视觉细节,意味着重新措辞再提一遍要求,然后祈祷其余部分别跟着动。现在您直接改那个碍眼的地方就行。反过来也行:在 Claude Design 里完成的设计稿可以发给 Claude Code 去开发,而 /design-sync 会把您仓库里的 React 组件体系上传上去,让设计稿用上您真实的组件。

适合界面草图、页面流程、落地页、社交图片、海报。请记住它还是 beta:工具变化很快,而且 /design 需要较新版本的 Claude Code。

子智能体:把活分出去,保持整洁

一个智能体可以调用子智能体:由它自己启动的辅助智能体,每个都有自己全新的上下文和一项明确的任务。一个子智能体去翻整个代码库,而主智能体继续干活。一个专门做代码评审的「评审员」子智能体。一个并行验证某个假设的子智能体。

为什么这很重要?有两个非常实际的理由。首先,它让主上下文保持整洁:在五十个文件里东翻西找的活,都在子智能体的脑子里完成,它只把结论回报给您。主线程不会被淹没在细节里。其次,它并行化:三个子智能体同时处理三个互不相干的部分,就是三倍的速度。

Claude Code 用子智能体和自定义的智能体类型(一个「探索者」智能体、一个「架构师」智能体……)把这件事正式化,每个都有自己的工具和自己的指令,存放在 .claude/agents/(项目级)或 ~/.claude/agents/(全局)。创建一个最简单的办法:向 Claude 描述它,由 Claude 写好文件。Codex 也是同样的思路:它会启动子智能体(用 /agent 命令在它们之间切换),您的自定义智能体则是一些小小的 TOML 文件,存放在 .codex/agents/(项目级)或 ~/.codex/agents/(全局)。我们会在下一篇里看具体的套路,何时该分活、怎么框定一个子智能体。眼下只需记住:这个能力是存在的,您的智能体并不孤单,它可以组建一支小队。

框定权限

这是所有设定里最重要的一个,也是最被忽视的一个。智能体会动手,所以它能弄坏东西。框定它的权限,就是决定哪些工具和哪些命令它可以自由运行,哪些需要您点头放行。正是在这里,非常具体地,您调节着上一篇里讲的那个自主程度滑块。

各处的积木都是一样的:

  • 白名单(allowlist)。 您预先授权那些无害且可回退的动作:读文件、运行测试、执行 git status。智能体把它们连成串而不打断您。
  • 「做 X 之前先问」规则。 凡是会修改或销毁的,删除、推送到远程分支、碰网络、装一个包,智能体都停下来问。这是日常设定:对无害的事流畅,对其余的事谨慎。
  • 绝不盲目 root。 永远别让一个智能体不经复审就连串地 sudo。一条没写对的特权命令,毁掉的不是一个项目,是整台机器。
  • 把工作目录关起来。 智能体只在您项目的文件夹里干活,别处一概不碰。一个只能往 ~/projets/mon-app 下写东西的智能体,就算搞错了,也碰不到别处。

配置与记忆

启动时,您的智能体会读取它的配置和它的记忆文件。常驻指令就住在这里:「这个项目用 pnpm,不用 npm」、「提交信息用中文写」、「永远别碰 legacy/ 文件夹」。您写一次,智能体每次会话都记得,不用您重复。正是这一点,把一个通用智能体变成一个懂您的项目和您的习惯的智能体。

这里不展开,记忆有它自己完整的一篇,在 记忆文件。记住它的角色就好:配置定义智能体能做什么、用哪些工具,记忆定义它对您的世界长期知道些什么。

Claude Code、Codex 与 OpenCode,并排比较

三个智能体共享同一套哲学,各有各的生态系统。它们提供的模型也不一样:Quelle IA 的编程工具页面(法语网站)列出了每个工具(Claude Code、Codex、OpenCode、Cursor……)里能用到哪些模型,以及各自的得分。

Claude Code 自带一个丰富而集成的生态:MCP 标配、子智能体和自定义智能体类型、事件钩子、skills(自定义命令已并入其中)以及把这一切打包在一起的插件。全部配置, MCP 服务器、权限、智能体、记忆,都住在 .claude/ 文件夹里(项目级别)或 ~/.claude/(全局,覆盖您所有会话)。

每个文件的确切格式(MCP 声明、子智能体定义、钩子语法),请查阅官方文档,链接在 资源 里。它变化很快,最好以源头为准。

操作步骤

这是从默认智能体走到为您量身定制的智能体的清单。

已完成 0 步,共 5 步 勾选记录只保存在此浏览器中。

  1. 决定它需要哪些工具

    从要完成的任务出发,技术自然随之而来。您想让它查询您的数据库?管理您的 GitHub issue?上网搜索?把缺的能力列出来,是它们决定接下来怎么做。没必要「以防万一」全都接上:每多接一个工具,就是多一扇要盯着的门。

  2. 有用就接上一个 MCP 服务器

    针对每一项识别出的能力,看看是否有现成的 MCP 服务器(filesystem、GitHub、Postgres、Slack……有几十个)。按它文档里的最新格式在您智能体的配置里声明它,重启,确认新工具出现了。

  3. 设好权限和白名单

    在任何正式使用之前:决定什么不用问就放行(读取、测试),什么需要您同意(删除、push、网络、sudo)。把工作目录关起来。拿不准就收紧,您以后可以放松。细节在 保护访问权限 里。

  4. 放好记忆和规则

    把常驻指令写进记忆文件:项目约定、要优先用的工具、禁区。正是它让您不必每次会话都重复同样的话。见 记忆文件。

  5. 在一个小任务上测试

    别一上来就把刚配好的智能体扔到大活上。先给它一个能调动新工具的微小任务,「给我列出最近 5 个 issue」、「users 表里有多少行」。您确认一切都接好了、权限按预期触发了,然后从容修正。

现在您有了一个像您的智能体:对的工具、对的数据、对的边界。剩下要学的,是让它在一个真实项目里活起来,文件放哪、团队怎么共享配置、哪些子智能体套路在日常里管用。

常见问题

Claude Code、Codex 和 OpenCode 都支持 MCP 吗?

是的,三者都支持 MCP。您在智能体的配置里声明服务器(一个名称、一条启动命令,有时还要一个 API 密钥),重启之后,新工具就会出现。filesystem、GitHub、Postgres、Slack 等常用服务器都有现成的。具体语法因智能体和版本而异,请以您所用智能体的最新文档为准。

把 MCP 服务器接到真实账号上有风险吗?

有:智能体会获得与您交给它的密钥相同的权限。一把 Meta 密钥能让它创建广告、修改预算,一把 GitHub 密钥能让它推送代码。请使用专用的服务账号,权限范围尽可能窄,凡是花钱或公开可见的操作都保留人工确认。

Claude Code 和 Codex 的自定义子智能体放在哪里?

Claude Code 的放在项目级的 .claude/agents/,或者对所有会话生效的 ~/.claude/agents/;最简单的做法是把想要的智能体描述给 Claude,由它来写文件。Codex 的自定义智能体是一些小的 TOML 文件,放在 .codex/agents/ 或 ~/.codex/agents/,用 /agent 命令可以在子智能体之间切换。

日常使用 Codex,权限该怎么设置?

Codex 把沙箱(read-only、workspace-write 或 danger-full-access)和审批策略(on-request 或 never)结合起来。日常推荐的设置是 codex --sandbox workspace-write --ask-for-approval on-request:它在项目目录里自由工作,要离开目录或访问网络之前会先征求您的同意。会话进行中可以用 /permissions 命令调整这些设置。

编程智能体的 hooks 有什么用?

hooks 把您自己的脚本挂到智能体的事件上:每改完一个文件就运行 linter,任务结束时播放提示音,拒绝包含密钥的提交。它们由运行框架本身触发,不取决于模型的意愿,所以很可靠。具体格式请查阅您所用智能体的文档。

本文涉及的术语: 智能体Claude CodeCodexOpenCodeGitMCPAPI子智能体记忆文件Commit(提交)

发现错误?

命令失效了,价格变了?

这些工具每个月都在变。请告诉我这篇文章哪里不对,我会改正并更新日期。

只保留页面、您的留言和选填的联系方式,别无其他。

第 19 / 31 篇 · 第 4 部分 还没有读过任何一篇 打开文章目录