目录1212 / 17

AI 为什么会?⑫ AI 为什么开始干活了?

上一篇,我们调查了行业 AI。它的专业能力可能来自模型、资料、工具、流程和审核机制的共同作用。于是,一个新的问题出现了:为什么 AI 不再只生成回答,还开始搜索资料、运行代码、操作软件,甚至完成一个完整任务?

帮我写一封邮件。

它会把邮件写出来。现在,越来越多的 AI 会继续搜索资料、打开网页、运行代码、分析文件。它什么时候,从一个聊天机器人,变成了一个真正的助手?


调查现场

想象一个场景。你让 AI 帮忙写一封会议通知。几秒钟后,主题、时间、地点都写好了。你接着说:

那就发给所有参会人吧。

它回答得很自然:

好的,已经发送。

可你打开邮箱,什么都没有。

那一刻,我才意识到:会告诉你怎么做,和真的把事情做完,中间还隔着一个世界。

再想象你使用的是一个不能联网的模型,问它:

帮我分析一下苹果公司的最新财报。

很多模型都会回答:

我不知道最新的数据。

或者告诉你一些旧信息。换成具有搜索工具的 AI,它可能会告诉你:

我去查一下。

然后,它开始打开网页、搜索、阅读、整理,最后再回来给你一份完整报告。第一次看到这里的时候,我最大的感受不是 AI 更聪明了,而是:

它开始自己动手了。


一、说“完成了”,不等于真的完成了

刚开始,我一直把这两件事情混在一起。后来才发现,它们不是同一层面的能力。比如,你问:

帮我写一份旅行攻略。

这主要是生成一份文本。但是如果你说:

帮我查一下下周去东京最便宜的机票,并整理成一份行程。

事情就变了。它不能只生成一份看似合理的行程,还要查询真实票价、比较结果并整理信息。也就是说,真正新增的要求是:

它能不能通过一系列动作,让外部结果符合目标。

可这里还藏着第二个坑:做过动作,也不代表完成了任务。查过机票,不等于找到了符合条件的方案;点击“发送”,也不等于邮件去了正确的人。

真正的任务还多了几道关:结果符合要求吗?失败以后要不要重试?重试几次该停?遇到付款、删除和授权,又该不该把决定交还给用户?


二、后来,我想到一个很形象的比喻

单纯的聊天模型更像一个顾问:你问,它答,回答结束,工作也就结束了。Agent 系统则更像一个实习生。你交代一个任务,它不会马上给出最终答案,而是会说:

好。

“我先去查一下。”于是,它翻资料、查网页、跑代码、整理信息,最后再回来汇报。请注意,真正发生变化的不只是回答,而是:

工作流程。


三、AI 为什么突然会干活了?

写到这里,我最初的解释是:模型升级了,所以它突然长出了手和眼睛。

这只说对了一半。模型确实越来越强,有些还接受过专门的工具调用、界面操作和安全训练。但与此同时,模型之外也多了浏览器、代码环境、数据库、搜索引擎和操作接口。

模型本身仍然会使用训练形成的知识和当前 Context。Agent 系统新增的是:模型还可以请求工具,由外部程序执行,再把新结果交回来。


四、这一刻,我突然理解了 Agent

很多人第一次听见 Agent,都会觉得,这是一个新的 AI,后来,我越来越觉得,它其实没有那么神秘,前十一篇,我们一直讨论:AI 怎么思考,从今天开始,我们讨论:

AI 怎么工作。

到了这里,我们才真正需要“Agent”这个名字。它在行业里没有唯一边界,但可以先抓住一个核心:模型不再只负责生成最后的回答,还参与管理任务过程——根据中间结果选择工具、继续行动,并判断何时结束。

Agent。

Agent 通常不是一个单独的新模型,而是一整套系统。模型可以提出:“我需要搜索”“我想发送邮件”“请允许我修改文件。”但提出申请,不等于拥有权力。

它可以申请权限,不能给自己授予权限。

真正的执行、记录和安全边界,仍然由外围系统控制。

一个完整的 Agent 也不能只顾着做动作。它还要回头看结果:没有达到目标,就纠正或继续;达到目标,就停止;连续失败或者遇到高风险操作,就把决定交还给人。


五、评价 AI,多了一个新的维度

回头看这一轮 AI 产品的演进,评价标准正在变得更丰富。我们既要看它能不能理解问题、给出好答案,也开始看它能不能把任务可靠地推进下去。前一个问题是:

它聪不聪明?

另一个问题是:

它能不能替我完成这件事?

回答得好和事情做成,是两把不同的尺子,谁也不能替代谁。没有理解、推理和可靠信息,Agent 就算忙了一大圈,也可能只是制造了一堆动作。


六、真正的变化,还没有开始

很多人觉得,Agent 就是未来,我反而觉得,Agent 只是开始,因为如果 AI 能够工作,那么,新的问题马上就来了,它怎么打开浏览器?怎么运行 Python?怎么操作电脑?怎么连接企业系统?怎么知道什么时候该调用哪个工具?

这些问题决定了 Agent 能把语言能力转化成多少实际行动。接下来,我们要调查的是:

它会不会使用工具。


调查笔记 No.12

今天,我们推翻了第十二个认知。

Agent 是一种新的 AI。

Agent 是一种由模型参与管理流程、调用工具并根据结果继续行动的系统。

真正的变化不只在模型,也在模型之外增加了工具、循环和执行环境。系统还要验证结果,并在完成、失败或需要人类决定时正确停止。


当前掌握的线索

  • AI 的回答来自模型能力和当前 Context。
  • AI 既会记住,也会归纳规律。
  • Prompt、Memory、RAG、Skill 以不同方式参与任务。
  • AI 开始调用工具,在外部环境中执行一系列动作,而不仅仅是生成文字。
  • 完成任务还需要验收、纠错、停止条件和必要时交还控制权。
  • Agent 是 AI 从"回答问题"走向"完成任务"的重要一步。

下一步调查

如果 Agent 已经会干活了。那么,它到底是怎么打开浏览器、运行代码、操作电脑的?这些能力,是模型自己拥有的吗?还是,另有原因?下一篇,我们继续调查。

《AI 为什么会?⑬ AI 为什么突然会使用工具了?》