你有没有过这种经历:新来的实习生坐在你旁边,脑子转得飞快,可你让他“查一下上周的订单”,他愣在那儿——因为他手上没有电脑,也没有账号。
AI 也一样。很多人以为它无所不能,其实它更像一个坐在空桌子前的实习生:会想,会说,但手边什么都没有。
它到底缺了什么?
先说清楚一件事:我们平时聊的 AI,核心是它的“脑子”——一个会读会写、能推理能总结的模型。
这个脑子很聪明,但它有三个天生的短板:
- 它不联网,看不到今天发生了什么;
- 它不直接动手,不能替你发邮件、改表格、下单;
- 它只记得这次对话,你上次跟它说过什么,它未必想得起来。
所以当你问“帮我看看我邮箱里那封合同”,它只能礼貌地告诉你:我看不到你的邮箱。
不是它不想帮,是它没有工具。
工具调用:实习生举手说“让我用一下”
真正的转折点,是给这个实习生配上工具。
所谓“工具”,说白了就是一些它能申请使用的小功能:查网页、算数、读文件、调接口。流程很像带新人:
- 你交代任务;
- 它想一下,发现“这事我得查资料”;
- 它举手申请:“让我用一下搜索工具”;
- 用完,拿到结果,再看下一步要干什么。
这个“想 → 申请 → 干 → 看结果”的来回,就叫循环。它不是一次答完,而是一步一步往前挪。
人话:工具调用 = 实习生申请“让我用一下某个工具”,用完把结果拿回来接着干。
那它是不是就无敌了?
不是。工具让 Agent 从“只会说”变成“能做事”,但边界也在这儿:
- 工具是有限的——没给它邮箱权限,它还是看不到你的邮件;
- 工具会出错——搜索结果可能过时,接口可能返回乱七八糟的东西;
- 它可能用错工具——该查数据库的时候去搜网页,绕一大圈。
还有个更隐蔽的问题:它有时候会不懂装懂。
人话:幻觉 = 它不知道答案,却编了一个听起来很像真的。
配上工具后,这种情况会少一些,因为“查一下”比“猜一下”靠谱。但工具本身也会给它错的信息,所以关键动作还是得你复核。
为什么有时候它记不住刚才说的话?
还有一个新手最容易困惑的点:聊着聊着,它好像忘了前面说过什么。
这跟它的“桌面”有关。
人话:上下文窗口 = 它这次能同时摆在桌上的便签纸,摆满了,旧的就得挪走。
便签纸是有限的。你们聊得越长、塞进去的资料越多,就越容易挤掉早先的内容。这不是它故意装傻,是桌子就这么大。
至于“记住你这个人”,那要靠另一套东西——相当于给它一个长期档案,把重要的事记下来,下次再翻出来看。这跟“这次桌上的便签”是两回事。
那到底什么时候别用它?
说句实在话:需要百分百准确、且错了代价很大的事,别全交给它。
比如报税数字、合同条款、医疗判断。它可以帮你查、帮你整理、帮你起草,但最后的确认得是人来做。
工具让它变强,也让它更容易“看起来很对”。这两件事是一体两面。
想动手试试?
如果你已经大概明白“脑子 + 工具 + 循环”是怎么回事,那就可以往下走了。
想亲手试试?Agent 核心概念入门 会带你从零跑通第一个 Agent。