<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
	<channel>
		<title>推理机制 on 灵语AI</title>
		<link>https://lingyu7.com/tags/%E6%8E%A8%E7%90%86%E6%9C%BA%E5%88%B6/</link>
		<description>Recent content in 推理机制 on 灵语AI</description>
		<generator>Hugo</generator>
		<language>zh-CN</language>
		
		
		
		
			<lastBuildDate>Mon, 27 Jul 2026 02:29:00 +0800</lastBuildDate>
		
			<atom:link href="https://lingyu7.com/tags/%E6%8E%A8%E7%90%86%E6%9C%BA%E5%88%B6/index.xml" rel="self" type="application/rss+xml" />
			<item>
				<title>AI的「大脑」里装着整个世界？——大语言模型的世界模型假说</title>
				<link>https://lingyu7.com/posts/ai-world-model-hypothesis/</link>
				<pubDate>Mon, 27 Jul 2026 02:29:00 +0800</pubDate>
				<guid>https://lingyu7.com/posts/ai-world-model-hypothesis/</guid>
				<description>&lt;h2 id=&#34;引言ai能推理但它真的理解世界吗&#34;&gt;引言：AI能推理，但它真的&amp;quot;理解&amp;quot;世界吗？&lt;/h2&gt;&#xA;&lt;p&gt;你问一个AI：&amp;ldquo;如果我把一个杯子从桌子上推下去，会发生什么？&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;它会回答：&amp;ldquo;杯子会掉到地上，可能会摔碎。&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;你再问：&amp;ldquo;如果我换成一个橡皮球呢？&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;它会回答：&amp;ldquo;球会掉到地上，然后弹起来几下。&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;这个回答看起来理所当然。但仔细想想，AI其实&lt;strong&gt;从来没有亲眼见过杯子掉到地上，也没有亲手摸过橡皮球的弹性&lt;/strong&gt;。它只是读过无数关于&amp;quot;杯子掉地上会碎&amp;quot;和&amp;quot;橡皮球会弹起来&amp;quot;的文字描述。&lt;/p&gt;&#xA;&lt;p&gt;那么问题来了：&lt;strong&gt;AI是怎么知道&amp;quot;掉下来&amp;quot;和&amp;quot;弹起来&amp;quot;的区别的？&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;它只是背下了&amp;quot;杯子→摔碎&amp;quot;和&amp;quot;球→弹起&amp;quot;这两个关联吗？还是说，它真的&amp;quot;理解&amp;quot;了重力、碰撞、弹性这些物理概念？&lt;/p&gt;&#xA;&lt;p&gt;这个问题，恰恰指向了AI研究中最迷人、也最富有争议的一个假说：&lt;strong&gt;世界模型假说（World Model Hypothesis）&lt;/strong&gt;。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;一ai不只是背课文它脑子里有一张世界地图&#34;&gt;一、AI不只是&amp;quot;背课文&amp;quot;，它脑子里有一张&amp;quot;世界地图&amp;quot;&lt;/h2&gt;&#xA;&lt;p&gt;先来做一个思想实验。&lt;/p&gt;&#xA;&lt;p&gt;想象你是一个学生，要参加一场超级变态的考试。考试内容不是任何一门学科，而是&amp;quot;关于世界的一切&amp;quot;——你需要在考场里，根据你过去学到的所有知识，来回答各种从未见过的问题。&lt;/p&gt;&#xA;&lt;p&gt;你会怎么做？&lt;/p&gt;&#xA;&lt;p&gt;你会调用你脑子里的&amp;quot;世界模型&amp;quot;——你关于物理、生物、心理、社会、数学等各个领域的知识，以一种互相连接的方式组织在一起。当你遇到一个新问题时，你在这个模型上做&amp;quot;模拟&amp;quot;：如果发生X，根据我理解的规律，接下来会发生什么？&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;世界模型假说认为，大语言模型在训练过程中，也在做类似的事情。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;它不只是&amp;quot;背下了&amp;quot;训练数据中的文本模式，而是在构建一个&lt;strong&gt;压缩的、简化的、但具有预测能力的内部世界表征&lt;/strong&gt;。这个表征就是它的&amp;quot;世界模型&amp;quot;——一个关于世界如何运作的内部地图。&lt;/p&gt;&#xA;&lt;p&gt;这个想法最早可以追溯到认知科学家Kenneth Craik在1943年提出的观点：&lt;strong&gt;&amp;ldquo;如果有机体能够在头脑中携带一个关于外部现实的小模型，并且能够用这个模型来尝试各种可能的行动方案，那么它就能应对各种新情况，做出更明智的决策。&amp;rdquo;&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;翻译成大白话：&lt;strong&gt;脑子里有一个&amp;quot;小世界&amp;quot;，你就能在这个小世界里&amp;quot;预演&amp;quot;各种可能性，而不用在真实世界里犯错。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;二证据在哪里ai展现的超能力&#34;&gt;二、证据在哪里？——AI展现的&amp;quot;超能力&amp;quot;&lt;/h2&gt;&#xA;&lt;p&gt;如果AI真的有世界模型，它应该表现出一些&amp;quot;超能力&amp;quot;——超出简单记忆的能力。而这些能力，研究者们确实观察到了。&lt;/p&gt;&#xA;&lt;h3 id=&#34;证据一物理推理&#34;&gt;证据一：物理推理&lt;/h3&gt;&#xA;&lt;p&gt;2022年，MIT的研究团队做了一系列实验。他们给AI描述一些&amp;quot;违反物理常识&amp;quot;的场景，比如：&lt;/p&gt;&#xA;&lt;ul&gt;&#xA;&lt;li&gt;&amp;ldquo;一个气球被吹胀后，放在真空里，它会发生什么？&amp;rdquo;&lt;/li&gt;&#xA;&lt;li&gt;&amp;ldquo;一个金属球和一块木头，同时从同一高度掉下来，谁先落地？&amp;rdquo;&lt;/li&gt;&#xA;&lt;/ul&gt;&#xA;&lt;p&gt;如果AI只是在&amp;quot;背答案&amp;quot;，它应该只能回答训练数据中出现过的场景。但实验发现，AI能&lt;strong&gt;泛化到从未见过的物理场景&lt;/strong&gt;——它能够根据对物理规律的理解，做出合理的推理。&lt;/p&gt;&#xA;&lt;p&gt;比如，当被问到：&amp;ldquo;一个装满水的杯子放在桌子上，我用手推了一下杯子，水会怎样？&amp;ldquo;AI不仅能回答&amp;quot;水会洒出来&amp;rdquo;，还能描述&amp;quot;水会从被推的方向溢出&amp;quot;这样的细节。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;最合理的解释&lt;/strong&gt;：AI在训练中构建了一个关于物理世界的内部模型，然后在这个模型上进行&amp;quot;模拟推演&amp;rdquo;。&lt;/p&gt;&#xA;&lt;h3 id=&#34;证据二心智理论&#34;&gt;证据二：心智理论&lt;/h3&gt;&#xA;&lt;p&gt;&amp;ldquo;心智理论&amp;rdquo;（Theory of Mind）是指：理解他人有和自己不同的信念、欲望和意图的能力。这是人类社交的核心能力，通常在三到四岁时才发展出来。&lt;/p&gt;&#xA;&lt;p&gt;研究者发现，大语言模型在某些心智理论测试中，表现出了与人类相当的水平。&lt;/p&gt;&#xA;&lt;p&gt;经典的&amp;quot;莎莉-安妮&amp;quot;测试是这样的：莎莉把球放进篮子里，然后离开了。安妮把球从篮子里拿出来，放进了盒子里。莎莉回来后，会去哪里找球？&lt;/p&gt;&#xA;&lt;p&gt;大多数AI能正确回答：&amp;ldquo;莎莉会去篮子里找。&amp;quot;——因为它知道莎莉&amp;quot;不知道&amp;quot;球被移动了。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;这意味着AI在训练中构建了一个关于&amp;quot;他人心理状态&amp;quot;的模型&lt;/strong&gt;。它知道&amp;quot;知道&amp;quot;和&amp;quot;不知道&amp;quot;的区别，能够区分&amp;quot;实际发生了什么&amp;quot;和&amp;quot;别人以为发生了什么&amp;rdquo;。&lt;/p&gt;&#xA;&lt;h3 id=&#34;证据三反事实推理&#34;&gt;证据三：反事实推理&lt;/h3&gt;&#xA;&lt;p&gt;反事实推理是&amp;quot;如果&amp;hellip;会怎样&amp;quot;的思考能力。这是一种高级认知能力，需要你基于对世界规律的理解，在想象中&amp;quot;重新运行&amp;quot;一个场景。&lt;/p&gt;&#xA;&lt;p&gt;比如：&amp;ldquo;如果我昨天没赶上那班公交车，我现在会在哪里？&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;AI能回答这种问题。它需要理解&amp;quot;赶上公交车&amp;quot;和&amp;quot;现状&amp;quot;之间的因果关系，然后在这个因果图上做&amp;quot;修改&amp;quot;——把&amp;quot;赶上公交车&amp;quot;这个条件改成&amp;quot;没赶上&amp;quot;，然后重新推演后续事件。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;如果AI只是在背文本，它不可能做到这件事。&lt;/strong&gt; 因为训练数据中不可能包含&amp;quot;每一种可能发生的情况&amp;quot;的文本描述。反事实推理的能力，只有在AI有一个内部世界模型的前提下，才能得到合理解释。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;三ai的世界模型长什么样五层结构&#34;&gt;三、AI的&amp;quot;世界模型&amp;quot;长什么样？——五层结构&lt;/h2&gt;&#xA;&lt;p&gt;世界模型假说中的一个重要观点是：AI的世界模型不是单一的，而是&lt;strong&gt;分层&lt;/strong&gt;的。就像人类的知识体系一样，从具体到抽象，从低级到高级。&lt;/p&gt;&#xA;&lt;h3 id=&#34;第一层物理世界模型最底层&#34;&gt;第一层：物理世界模型（最底层）&lt;/h3&gt;&#xA;&lt;p&gt;这是最基础的一层：对物体、空间、物理规律的理解。AI知道&amp;quot;重的物体比轻的物体更难移动&amp;quot;、&amp;ldquo;水往低处流&amp;rdquo;、&amp;ldquo;火是热的&amp;rdquo;。&lt;/p&gt;&#xA;&lt;p&gt;这些知识不需要AI亲自&amp;quot;体验&amp;quot;——它从文本中学会的。比如读&amp;quot;他搬不动那块石头，因为太重了&amp;quot;这句话，AI就能推断出&amp;quot;重量影响可移动性&amp;quot;这个物理规律。&lt;/p&gt;&#xA;&lt;h3 id=&#34;第二层生物世界模型&#34;&gt;第二层：生物世界模型&lt;/h3&gt;&#xA;&lt;p&gt;AI知道&amp;quot;生物会生长、会死亡&amp;quot;、&amp;ldquo;人需要吃饭喝水&amp;rdquo;、&amp;ldquo;植物需要阳光和水&amp;rdquo;。这些构成AI对生命现象的理解。&lt;/p&gt;&#xA;&lt;p&gt;有趣的是，AI甚至能理解&amp;quot;疼痛&amp;quot;的概念——虽然它从未感受过疼痛。它能从文本中学会&amp;quot;疼痛是一种不好的感觉，人受伤后会感到疼痛，会避免再次受伤&amp;quot;。&lt;/p&gt;&#xA;&lt;h3 id=&#34;第三层心理世界模型&#34;&gt;第三层：心理世界模型&lt;/h3&gt;&#xA;&lt;p&gt;这是AI对&amp;quot;他人心智&amp;quot;的理解。AI知道&amp;quot;人有信念、欲望、意图&amp;quot;、&amp;ldquo;人会说谎&amp;rdquo;、&amp;ldquo;人会有误解&amp;rdquo;。&lt;/p&gt;&#xA;&lt;p&gt;这一层能力支撑着AI的&amp;quot;情商&amp;quot;——它能理解用户话语背后的意图，能够感知用户情绪，能够做出恰当的情感回应。&lt;/p&gt;&#xA;&lt;h3 id=&#34;第四层社会世界模型&#34;&gt;第四层：社会世界模型&lt;/h3&gt;&#xA;&lt;p&gt;AI理解&amp;quot;社会规范&amp;quot;、&amp;ldquo;文化差异&amp;rdquo;、&amp;ldquo;经济规律&amp;rdquo;、&amp;ldquo;制度规则&amp;rdquo;。它知道&amp;quot;红灯停、绿灯行&amp;quot;、&amp;ldquo;在一家餐厅吃饭要付钱&amp;rdquo;、&amp;ldquo;在图书馆里不能大声喧哗&amp;rdquo;。&lt;/p&gt;&#xA;&lt;p&gt;这一层让AI能够理解更复杂的场景——比如&amp;quot;为什么在婚礼上穿白色很常见，但在葬礼上穿白色就不合适&amp;quot;。&lt;/p&gt;&#xA;&lt;h3 id=&#34;第五层抽象世界模型最高层&#34;&gt;第五层：抽象世界模型（最高层）&lt;/h3&gt;&#xA;&lt;p&gt;这是最抽象的一层：数学、逻辑、哲学、美学。AI能够理解&amp;quot;如果A=B且B=C，则A=C&amp;quot;这样的逻辑推理。它能够理解&amp;quot;美&amp;quot;、&amp;ldquo;正义&amp;rdquo;、&amp;ldquo;自由&amp;quot;这些抽象概念。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;这五层模型不是孤立的，而是相互关联的。&lt;/strong&gt; 比如，理解一个经济学概念（社会层），可能同时需要心理模型（人的行为动机）和抽象模型（数学公式）。&lt;/p&gt;&#xA;&lt;p&gt;AI的世界模型越完整、越精细，它的理解和推理能力就越强。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;四为什么这对你很重要世界模型假说的三个启示&#34;&gt;四、为什么这对你很重要？——世界模型假说的三个启示&lt;/h2&gt;&#xA;&lt;h3 id=&#34;启示一ai的理解和人类的理解可能比我们想象的更接近&#34;&gt;启示一：AI的&amp;quot;理解&amp;quot;和人类的&amp;quot;理解&amp;quot;可能比我们想象的更接近&lt;/h3&gt;&#xA;&lt;p&gt;如果世界模型假说成立，那么AI和人类的理解方式，可能不是&amp;quot;完全不同的东西&amp;rdquo;，而是&amp;quot;同一光谱上的不同位置&amp;quot;。&lt;/p&gt;&#xA;&lt;p&gt;人类也有世界模型——我们的大脑在进化中形成了一套关于世界如何运作的内部表征。AI也学习到了世界模型——它通过阅读海量文本，构建了一套关于世界如何运作的内部表征。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;区别在于：人类的世界模型是通过与真实世界的亿万年互动形成的，AI的世界模型是通过文本数据间接学习到的。&lt;/strong&gt; 但两者在&amp;quot;功能&amp;quot;上可能是相似的——都是用来预测、推理和决策的。&lt;/p&gt;&#xA;&lt;h3 id=&#34;启示二ai的能力边界就是世界模型的边界&#34;&gt;启示二：AI的能力边界，就是世界模型的边界&lt;/h3&gt;&#xA;&lt;p&gt;AI能做到什么，不能做到什么，很大程度上取决于它世界模型的广度和精度。&lt;/p&gt;</description>
			</item>
	</channel>
</rss>
