<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
	<channel>
		<title>ReAct on 灵语AI</title>
		<link>https://lingyu7.com/tags/react/</link>
		<description>Recent content in ReAct on 灵语AI</description>
		<generator>Hugo</generator>
		<language>zh-CN</language>
		
		
		
		
			<lastBuildDate>Tue, 15 Sep 2026 18:30:00 +0800</lastBuildDate>
		
			<atom:link href="https://lingyu7.com/tags/react/index.xml" rel="self" type="application/rss+xml" />
			<item>
				<title>AI再聪明，没有&#39;手&#39;也白搭——工具使用如何把AI从书呆子变成实干家</title>
				<link>https://lingyu7.com/posts/ai-tool-use-from-brain-to-agent/</link>
				<pubDate>Tue, 15 Sep 2026 18:30:00 +0800</pubDate>
				<guid>https://lingyu7.com/posts/ai-tool-use-from-brain-to-agent/</guid>
				<description>&lt;h2 id=&#34;引言&#34;&gt;引言&lt;/h2&gt;&#xA;&lt;p&gt;想象一下：&lt;/p&gt;&#xA;&lt;p&gt;你是世界上最聪明的人。你读过所有书，知道所有知识。但——你没有双手，无法触碰任何东西，也不能用任何工具。&lt;/p&gt;&#xA;&lt;p&gt;有人问你：&amp;ldquo;鱼香肉丝怎么做？&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;你能把步骤背得一字不差。&amp;ldquo;猪肉切丝腌制，泡椒剁碎，调好糖醋汁…&amp;ldquo;每一步都说得清清楚楚。&lt;/p&gt;&#xA;&lt;p&gt;但你没法真的走进厨房。&lt;/p&gt;&#xA;&lt;p&gt;你没法拿起菜刀、打开燃气灶、尝一口咸淡。你知道一切，却做不了任何事。&lt;/p&gt;&#xA;&lt;p&gt;听起来很荒谬？但这恰恰是目前大多数AI的真实处境。&lt;/p&gt;&#xA;&lt;p&gt;大语言模型就像这个&amp;quot;天才书呆子&amp;rdquo;——它们读过海量文本，知道多得惊人的知识，但如果没有工具的帮助，它们永远只能停留在&amp;quot;说话&amp;quot;的层面。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;工具使用（Tool Use），是AI从&amp;quot;知道分子&amp;quot;走向&amp;quot;实干家&amp;quot;的关键一跃。&lt;/strong&gt; 这篇文章，我要带你看看这一跃是怎么发生的。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;一ai的五个先天缺陷为什么光有知识不够&#34;&gt;一、AI的五个&amp;quot;先天缺陷&amp;rdquo;——为什么光有知识不够&lt;/h2&gt;&#xA;&lt;p&gt;你可能会想：AI不已经能写文章、写代码、回答问题了吗？这还不够？&lt;/p&gt;&#xA;&lt;p&gt;不够。因为纯语言模型有五个无法绕过的天花板：&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;第一，知识的保质期。&lt;/strong&gt; 一个模型的训练数据截止于某一天。那之后发生的事情，它一概不知。去年的大选结果、今天的热搜、刚刚发布的财报——它要么不知道，要么只能编一个。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;第二，事实的不确定性。&lt;/strong&gt; 模型经常&amp;quot;编故事&amp;quot;——这就是AI幻觉（Hallucination）。一个没有数据库、搜索引擎可以查证的语言模型，就像一个参加闭卷考试的学生：遇到不会的题，它只能硬编一个答案，还假装很确定。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;第三，数学的短板。&lt;/strong&gt; 大模型对语言很擅长，但对精确计算却很笨。你让它算&amp;quot;3857×926&amp;quot;，它可能给出一个接近但不准确的数字。它靠的是&amp;quot;猜&amp;quot;而不是&amp;quot;算&amp;quot;。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;第四，与真实世界的隔离。&lt;/strong&gt; 模型只能读写文本。它没法打开网页查询实时信息，没法发送邮件，没法操作你的日历，没法控制智能家居。它生活在&amp;quot;语言的世界&amp;quot;里，不是&amp;quot;物理的世界&amp;quot;。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;第五，专业知识的深度限制。&lt;/strong&gt; 一个模型可以&amp;quot;懂&amp;quot;很多领域，但在任何一个垂直领域，都不如该领域的专业工具。金融领域的彭博终端、医疗领域的影像诊断系统、工程领域的CAD软件——每个领域都有比通用AI更强大的专用工具。&lt;/p&gt;&#xA;&lt;p&gt;你发现了吗？这五个缺陷都有一个共同的解决方案——&lt;strong&gt;给AI装上手和脚，让它学会使用工具。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;二一个你每天在用的ai工具使用案例&#34;&gt;二、一个你每天在用的&amp;quot;AI工具使用&amp;quot;案例&lt;/h2&gt;&#xA;&lt;p&gt;在深入技术之前，先看一个你很可能已经体验过的场景。&lt;/p&gt;&#xA;&lt;p&gt;你正在用某个AI助手。你问它：&amp;ldquo;帮我查一下今天北京的天气。&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;它怎么做的？&lt;/p&gt;&#xA;&lt;p&gt;第一步，它意识到&lt;strong&gt;自己不知道今天的天气&lt;/strong&gt;（因为训练数据不包含实时信息）。&lt;/p&gt;&#xA;&lt;p&gt;第二步，它&lt;strong&gt;主动选择&lt;/strong&gt;使用一个搜索或天气API工具。&lt;/p&gt;&#xA;&lt;p&gt;第三步，它&lt;strong&gt;构造正确的参数&lt;/strong&gt;——把&amp;quot;北京&amp;quot;&amp;ldquo;今天&amp;quot;转换成API能理解的格式（比如城市代码和日期）。&lt;/p&gt;&#xA;&lt;p&gt;第四步，它&lt;strong&gt;调用工具&lt;/strong&gt;，获取返回结果：&amp;ldquo;多云，15-25°C&amp;rdquo;。&lt;/p&gt;&#xA;&lt;p&gt;第五步，它&lt;strong&gt;理解工具返回的结果&lt;/strong&gt;，把它组织成一句通顺的话告诉你。&lt;/p&gt;&#xA;&lt;p&gt;这个过程看起来很简单，但每一步都是一个巨大的技术跨越。&lt;/p&gt;&#xA;&lt;p&gt;在2020年之前，没有任何AI能做到这种&amp;quot;主动判断自己不知道什么→决定用工具→正确使用工具→理解工具返回结果&amp;quot;的完整流程。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;这是AI从&amp;quot;被动回答问题&amp;quot;到&amp;quot;主动解决问题&amp;quot;的分水岭。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;三思考-行动-观察ai干活的三步循环&#34;&gt;三、&amp;ldquo;思考-行动-观察&amp;rdquo;：AI干活的三步循环&lt;/h2&gt;&#xA;&lt;p&gt;AI使用工具的背后，有一个非常优雅的核心架构——&lt;strong&gt;ReAct循环&lt;/strong&gt;。&lt;/p&gt;&#xA;&lt;p&gt;这个名字是两个词的组合：&lt;strong&gt;Rea&lt;/strong&gt;soning（推理）+ &lt;strong&gt;Act&lt;/strong&gt;ion（行动）。它模仿了人类解决问题时最自然的方式：边想边做，边做边看，边看边调整。&lt;/p&gt;&#xA;&lt;h3 id=&#34;第一步thought思考&#34;&gt;第一步：Thought（思考）&lt;/h3&gt;&#xA;&lt;p&gt;&amp;ldquo;我知道什么？我还需要什么？哪种工具可以帮我获取我需要的信息？&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;这是AI的&amp;quot;大脑&amp;quot;在工作。不是立刻回答，而是先规划。&lt;/p&gt;&#xA;&lt;h3 id=&#34;第二步action行动&#34;&gt;第二步：Action（行动）&lt;/h3&gt;&#xA;&lt;p&gt;&amp;ldquo;好，我用搜索引擎查这个关键词。&amp;rdquo;&#xA;&amp;ldquo;我用计算器算这个结果。&amp;rdquo;&#xA;&amp;ldquo;我调数据库里的这条记录。&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;这是AI的&amp;quot;手&amp;quot;在工作。它调用工具，改变外部环境。&lt;/p&gt;&#xA;&lt;h3 id=&#34;第三步observation观察&#34;&gt;第三步：Observation（观察）&lt;/h3&gt;&#xA;&lt;p&gt;&amp;ldquo;嗯，搜索返回了三条结果。第一第二条似乎相关，第三条不太对。&amp;rdquo;&#xA;&amp;ldquo;计算器给我了一个数字：3571822。&amp;rdquo;&#xA;&amp;ldquo;数据库找到了我要的记录。&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;这是AI的&amp;quot;眼睛&amp;quot;在工作。工具返回的信息被感知和理解。&lt;/p&gt;&#xA;&lt;p&gt;然后，循环继续：&lt;/p&gt;&#xA;&lt;p&gt;&amp;ldquo;基于刚才的搜索结果，我好像理解错了用户的问题，需要重新搜索……&amp;rdquo;&#xA;&amp;ldquo;有了新信息，我再想一下……&amp;rdquo;&#xA;&amp;ldquo;确认了，现在我可以给出最终答案了。&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;这个&amp;quot;思考→行动→观察→再思考&amp;quot;的循环，让AI不再是一个&amp;quot;一次性的答题机器&amp;rdquo;，而变成了一个&lt;strong&gt;可以持续探索、不断迭代的智能工作者&lt;/strong&gt;。&lt;/p&gt;&#xA;&lt;p&gt;在一项实验中，使用ReAct循环的AI在ALFWorld（一个模拟家庭环境的测试）中的任务完成率达到了71%，而普通方法只有37%。换句话说，光是加上这个&amp;quot;想→做→看&amp;quot;的循环，AI的实用能力就能翻倍。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;四工具使用的五个层次你的ai到哪一级了&#34;&gt;四、工具使用的五个层次——你的AI到哪一级了？&lt;/h2&gt;&#xA;&lt;p&gt;不是所有&amp;quot;工具使用&amp;quot;都是一回事。从笨拙到老练，AI的工具使用能力可以分成五个层次：&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;L1：被动调用。&lt;/strong&gt; 人类告诉AI&amp;quot;用计算器算这个&amp;quot;，AI才去算。这是最低层次，AI没有主动性。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;L2：主动选择。&lt;/strong&gt; AI自己判断&amp;quot;这个问题我答不了，我需要查资料&amp;quot;。它自己决定什么时候该用什么工具。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;L3：参数构造。&lt;/strong&gt; 不只是选对了工具，还能正确填入参数。比如调用天气API时，知道要把&amp;quot;北京&amp;quot;转成&amp;quot;beijing&amp;quot;，把&amp;quot;今天&amp;quot;转成今天的日期。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;L4：多步编排。&lt;/strong&gt; 能组合多个工具完成复杂任务。先搜索背景信息，再调用分析工具处理数据，最后用图表工具生成可视化。就像人类完成一个项目时，会使用多种工具协同工作。&lt;/p&gt;</description>
			</item>
	</channel>
</rss>
