跳到正文
全部 31 篇FREN中文
目录
第 2 部分 · 第 4 篇,共 6 篇 难度:简单 阅读时间:12 分钟

什么是 AI 智能体(agent)?

智能体不是聊天机器人。它是一个被放出盒子、被赋予了工具和目标的模型。下面讲清楚它到底是怎么运作的,真实、没有魔法。

本文目录
  1. 01模型、聊天机器人、智能体:三样不同的东西
  2. 02循环,一切的核心
  3. 03工具:给大脑装上双手
  4. 04自主程度:一个可以调节的滑块
  5. 05这对爱折腾的人意味着什么
  6. 06常见问题

要点速览

AI 智能体是一个被赋予了目标、行动工具(读写文件、执行命令、上网搜索)和一个循环的语言模型,它会反复尝试,直到把事情做完。聊天机器人只给建议,智能体则直接执行,所以您需要设定它的自主程度,并复查它做了什么。Claude Code 和 OpenCode 就是这类智能体,开箱即可用于开发工作。

请先完成: 安装 agent(趁早)

您已经安装了 Claude Code 或 OpenCode,看着它写文件、运行命令、修正自己的错误。这很震撼,也有点像魔法。但其实没有任何魔法,只有一个简单而强大的想法。花五分钟来把它拆解开:一旦您理解了智能体是什么,您就知道该对它抱什么期待,更重要的是知道不该抱什么期待。

模型、聊天机器人、智能体:三样不同的东西

人们常常把这三者混为一谈。但区别其实很清晰:

  • 语言模型(LLM) 是纯粹的引擎。您给它文本,它还您文本。它不做别的任何事。它不知道现在几点,读不了您的文件,记不住任何东西。
  • 聊天机器人 是装进了对话界面里的模型。用来思考、撰写、解释都很方便。但它仍然被困在自己的文字泡泡里:它建议您执行某条命令,但它不会去执行。
  • 智能体 是被赋予了三样东西的模型:一个目标、一批能作用于现实世界的工具,以及一个让它不断重来直到目标达成的循环。这时它不再是建议:它在动手。

循环,一切的核心

每一个智能体,无论是 Claude Code、OpenCode 还是别的,都运转在同一个循环上。正是这个循环,把一个话痨模型变成了一个自主的工作者:

1 · 您 目标 您的请求
2 · 模型 思考、决策 做什么、用哪个工具
3 · 工具 行动 读写文件、运行命令、调用 API…
4 · 反馈 观察结果 再交回给模型
↻ 循环直到「完成」
智能体的循环:它接收一个目标,模型思考并决定一个行动,它使用一个工具,观察结果,然后重来,直到「完成了」。

我们来展开一个具体的例子。您问:「测试通过了吗?」。智能体不靠猜,它在循环:

  1. 思考,「要知道答案,我得运行测试命令。」
  2. 行动(工具) : 它在您的终端里执行 npm test。
  3. 观察 : 它读取输出:三个测试失败,在某个文件里。
  4. 思考,「报错说函数返回了 null。我去读那个文件。」
  5. 行动 : 它打开文件,定位 bug,写出修正。
  6. 行动 : 它重新运行 npm test。
  7. 观察 : 全绿了。目标达成,它停下。

没有人把这些步骤一一口述给它。是它自己选的,一步接一步,根据它所观察到的情况。这就是智能体:一个在循环中决定自己下一步行动的模型,每一步都依据上一步的结果。

工具:给大脑装上双手

一个智能体的价值,全在于您给它的工具。一个工具,就是一种行动能力:读一个文件、写一个文件、运行一条 shell 命令、调用一个 API、上网搜索。工具的清单越丰富,智能体能完成的事就越多。

Claude Code 和 OpenCode 出厂就为开发配齐了工具:文件系统、终端、搜索、git。而您还可以扩展这份清单,这正是下一篇的主题,搭建您的智能体。

大脑和双手同样重要。并不是每个模型都能稳稳地跑完这个循环:有的能连续执行二十个动作而不迷路,有的三步之后就跑偏了。Quelle IA 网站有一份智能体模型排行榜(法语网站),衡量的正是模型独立连续执行动作的能力。

自主程度:一个可以调节的滑块

「自主智能体」让人害怕,或让人向往,看心情。现实更微妙:自主程度是一个由您来调的滑块。

  • 每个行动您都确认。 智能体提议,您逐一批准。慢,但完全掌控,刚上手时、或处理敏感操作时最合适。
  • 只确认有风险的动作。 智能体可以自由地连续读取和测试,但在删除、推送或碰网络之前会先问您。这是日常的最佳设定。
  • 放手让它跑。 在一个边界清晰、可回退的任务上(一次有测试覆盖的重构),您放开手,最后复审结果。

Claude Code 把这些档位做成了权限模式:逐一手动批准、自动接受文件修改、计划模式(只提方案,不动任何东西),以及「auto」模式,由一个分类器替您审查每个动作。OpenCode 有自己的设置,逻辑相同。

这对爱折腾的人意味着什么

因为它改变了您的角色。您从「敲命令的人」变成「拍板和复审的人」。您用中文描述一个意图,智能体把它翻译成一连串具体行动,您来确认。这正是为什么一台迷你机器在一个并非系统管理员的人手里也能如此强大:智能体做技术性的动作,您来把握方向。

常见问题

语言模型在没有工具的情况下能做什么?

只能把文本变成文本。一个裸的语言模型不知道现在几点,读不了您的文件,也什么都记不住。正是围绕它加上的目标、工具和循环,才让它成为能够行动的智能体。

AI 智能体的循环是怎样运作的?

智能体接到一个目标,先思考,选定一个动作,调用工具,观察结果,然后重新开始,直到达成目标。比如要确认测试是否通过,它会运行测试命令、读取报错、打开出错的文件并修复,再重新运行测试,全部通过后才停下。没有人给它规定这些步骤:它根据观察到的情况自己选择。

所有模型驱动智能体的能力都一样吗?

不一样。有的模型能连续执行二十个动作而不跑偏,有的三步之后就迷失了。Quelle IA 网站维护着一份智能体模型排行榜,衡量的正是这种独立连续执行动作的能力。

应该给编码智能体多大的自主权?

这是一个要根据风险来调节的滑块。刚开始或处理敏感内容时,逐条批准每个动作;日常使用时,只批准有风险的操作(删除、推送、动网络);面对边界清晰、可以回退的任务,比如有测试覆盖的重构,就放手让它做。新手时收紧,等摸清智能体擅长什么之后再放宽。

Claude Code 有哪些权限模式?

Claude Code 提供手动批准、自动接受文件修改、只提方案不动手的计划模式,以及由分类器替您审查每个动作的「auto」模式。OpenCode 有自己的设置,逻辑相同。

本文涉及的术语: 智能体LLM(大语言模型)Claude CodeOpenCodeShellAPIGit

发现错误?

命令失效了,价格变了?

这些工具每个月都在变。请告诉我这篇文章哪里不对,我会改正并更新日期。

只保留页面、您的留言和选填的联系方式,别无其他。

第 12 / 31 篇 · 第 2 部分 还没有读过任何一篇 打开文章目录