<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
	<channel>
		<title>因果发现 on 灵语AI</title>
		<link>https://lingyu7.com/tags/%E5%9B%A0%E6%9E%9C%E5%8F%91%E7%8E%B0/</link>
		<description>Recent content in 因果发现 on 灵语AI</description>
		<generator>Hugo</generator>
		<language>zh-CN</language>
		
		
		
		
			<lastBuildDate>Fri, 07 Aug 2026 03:17:00 +0800</lastBuildDate>
		
			<atom:link href="https://lingyu7.com/tags/%E5%9B%A0%E6%9E%9C%E5%8F%91%E7%8E%B0/index.xml" rel="self" type="application/rss+xml" />
			<item>
				<title>AI终于学会了问「为什么」——因果推断如何让机器从「看相似」进化到「懂因果」</title>
				<link>https://lingyu7.com/posts/ai-why-causal-inference/</link>
				<pubDate>Fri, 07 Aug 2026 03:17:00 +0800</pubDate>
				<guid>https://lingyu7.com/posts/ai-why-causal-inference/</guid>
				<description>&lt;h2 id=&#34;引言冰激凌对不起&#34;&gt;引言：冰激凌对不起&lt;/h2&gt;&#xA;&lt;p&gt;先做一个简单的思维实验。&lt;/p&gt;&#xA;&lt;p&gt;假设你是一名数据分析师，手头有一份过去五年的统计数据。你发现：&lt;strong&gt;冰激凌销量越高的日子，溺水死亡人数也越高&lt;/strong&gt;。相关性高达0.87，非常显著。&lt;/p&gt;&#xA;&lt;p&gt;你会不会写一份报告，建议&amp;quot;为了减少溺水事故，应该严格控制冰激凌销售&amp;quot;？&lt;/p&gt;&#xA;&lt;p&gt;你的直觉大概率告诉你：不对。冰激凌不会杀人，真正的原因是&lt;strong&gt;夏天到了&lt;/strong&gt;——天气热，大家既想吃冰激凌，又想去游泳。游泳的人多了，溺水事故自然增加。冰激凌销量和溺水率之间是&lt;strong&gt;相关关系&lt;/strong&gt;，但不是&lt;strong&gt;因果关系&lt;/strong&gt;。&lt;/p&gt;&#xA;&lt;p&gt;这个例子太简单了，你一眼就能看穿。但问题在于：&lt;strong&gt;AI能看穿吗？&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;传统机器学习模型（包括今天的GPT级大语言模型）本质上是一个&amp;quot;超级模式匹配器&amp;quot;——它从海量数据中找相关性，然后用人眼无法企及的精度去拟合这些模式。但它&lt;strong&gt;不区分&lt;/strong&gt;哪些是真正的因果，哪些只是&amp;quot;夏天来了&amp;quot;式的巧合。&lt;/p&gt;&#xA;&lt;p&gt;这就是因果推断（Causal Inference）要解决的核心问题：&lt;strong&gt;如何让AI不仅会&amp;quot;看见&amp;quot;，还会&amp;quot;理解&amp;quot;？&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;h2 id=&#34;一三根横杠因果的阶梯&#34;&gt;一、三根横杠：因果的阶梯&lt;/h2&gt;&#xA;&lt;p&gt;因果推断领域的奠基人、图灵奖得主Judea Pearl（朱迪亚·珀尔）提出了一个著名的&lt;strong&gt;因果层级理论&lt;/strong&gt;，把认知能力分为三个层级。你可以把它想象成三根横杠，每跨过一根，AI的认知能力就跃升一个维度。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;第一层：看见（关联）&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;这一层只做一件事：找模式。比如&amp;quot;冰激凌销量高时溺水率也高&amp;quot;、&amp;ldquo;买婴儿尿布的男性也喜欢买啤酒&amp;rdquo;（这是沃尔玛真实的经典数据挖掘案例）。AI能发现这些规律，但它不知道&lt;strong&gt;为什么&lt;/strong&gt;。这是今天绝大多数AI所处的层级——包括GPT、图像识别、推荐系统。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;第二层：干预（做事）&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;这一层开始问&amp;quot;如果我做了什么，会发生什么？&amp;quot;。比如：如果我&lt;strong&gt;强制&lt;/strong&gt;在所有海滩禁止冰激凌销售，溺水率会下降吗？注意，这里的关键词是&amp;quot;强制&amp;quot;——不是观察，而是主动干预。&lt;/p&gt;&#xA;&lt;p&gt;Pearl用了一个叫 &lt;strong&gt;do-演算&lt;/strong&gt; 的数学工具来处理这种问题。它本质上是一个&amp;quot;反事实计算器&amp;quot;：给定一个因果图（变量之间如何相互影响的路线图），do-演算可以告诉你，即使没有做实验，从观察数据中也能推断出&amp;quot;如果做了某件事会产生什么效果&amp;quot;。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;第三层：反事实（想象）&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;这一层是最高的认知能力——&lt;strong&gt;&amp;ldquo;如果当初……会怎样？&amp;rdquo;&lt;/strong&gt; 比如：如果那个溺水的人昨天没有去游泳会怎样？如果我没有把雨伞忘在家里，是不是就不会淋湿？&lt;/p&gt;&#xA;&lt;p&gt;反事实推理是人类最核心的智能之一。它让我们能从失败中学习（&amp;ldquo;如果当初选了另一条路……&amp;quot;），让我们能规划未来（&amp;ldquo;如果明天下雨，我就带伞&amp;rdquo;），让我们能理解别人的感受（&amp;ldquo;如果我是他……&amp;quot;）。&lt;/p&gt;&#xA;&lt;p&gt;今天的AI，绝大多数停留在第一层。而因果推断的目标，就是让AI登上第二层、第三层。&lt;/p&gt;&#xA;&lt;h2 id=&#34;二辛普森悖论你以为你看到的可能是错的&#34;&gt;二、辛普森悖论：你以为你看到的，可能是错的&lt;/h2&gt;&#xA;&lt;p&gt;有一个著名的统计学谜题，叫&lt;strong&gt;辛普森悖论&lt;/strong&gt;，它完美地展示了为什么&amp;quot;相关性&amp;quot;会骗人。&lt;/p&gt;&#xA;&lt;p&gt;假设有一家医院，统计了两种治疗方案（A和B）对肾结石患者的疗效：&lt;/p&gt;&#xA;&lt;table&gt;&#xA;&#x9;&lt;thead&gt;&#xA;&#x9;&#x9;&#x9;&lt;tr&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;th&gt;治疗方案&lt;/th&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;th&gt;小颗结石患者&lt;/th&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;th&gt;大颗结石患者&lt;/th&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;th&gt;总体治愈率&lt;/th&gt;&#xA;&#x9;&#x9;&#x9;&lt;/tr&gt;&#xA;&#x9;&lt;/thead&gt;&#xA;&#x9;&lt;tbody&gt;&#xA;&#x9;&#x9;&#x9;&lt;tr&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;td&gt;方案A&lt;/td&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;td&gt;93%（81/87）&lt;/td&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;td&gt;73%（192/263）&lt;/td&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;td&gt;&lt;strong&gt;78%&lt;/strong&gt;&lt;/td&gt;&#xA;&#x9;&#x9;&#x9;&lt;/tr&gt;&#xA;&#x9;&#x9;&#x9;&lt;tr&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;td&gt;方案B&lt;/td&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;td&gt;87%（234/270）&lt;/td&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;td&gt;69%（55/80）&lt;/td&gt;&#xA;&#x9;&#x9;&#x9;&#x9;&#x9;&lt;td&gt;&lt;strong&gt;83%&lt;/strong&gt;&lt;/td&gt;&#xA;&#x9;&#x9;&#x9;&lt;/tr&gt;&#xA;&#x9;&lt;/tbody&gt;&#xA;&lt;/table&gt;&#xA;&lt;p&gt;奇怪的事情发生了：方案A在小颗结石和大颗结石的&lt;strong&gt;分组&lt;/strong&gt;中治愈率都更高，但到了&lt;strong&gt;总体&lt;/strong&gt;上，方案B的治愈率反而更高了！&lt;/p&gt;&#xA;&lt;p&gt;这是怎么回事？因为方案A接诊的患者中，大颗结石（难治）的比例更高（263/350 ≈ 75%），而方案B接诊的患者中，大颗结石的比例更低（80/350 ≈ 23%）。这种&lt;strong&gt;患者分配的不均衡&lt;/strong&gt;扭曲了总体的比较。&lt;/p&gt;&#xA;&lt;p&gt;这就是&lt;strong&gt;混杂因子&lt;/strong&gt;（confounder）——一个同时影响&amp;quot;处理&amp;quot;和&amp;quot;结果&amp;quot;的隐藏变量。在这里，结石大小就是混杂因子：它既影响医生选择哪种方案（医生倾向于给大结石患者用方案A），也影响治疗结果（大结石更难治愈）。&lt;/p&gt;&#xA;&lt;p&gt;传统AI会说：&amp;ldquo;方案B总体治愈率更高，选方案B。&amp;ldquo;但因果推断会说：&amp;ldquo;等一下，我们需要&amp;rsquo;控制&amp;rsquo;结石大小这个变量——在同样大小结石的患者中，方案A才是更好的选择。&amp;rdquo;&lt;/p&gt;&#xA;&lt;p&gt;这个悖论告诉我们：&lt;strong&gt;当你没有理解因果关系时，数据本身会骗你。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;h2 id=&#34;三因果推断给了ai什么新能力&#34;&gt;三、因果推断给了AI什么新能力？&lt;/h2&gt;&#xA;&lt;p&gt;因果推断不是理论玩具，它已经在给AI带来实实在在的新能力。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;1. 能&amp;quot;想象&amp;quot;的生成模型——CausalGAN&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;2018年，研究者提出了CausalGAN——一个&amp;quot;懂因果&amp;quot;的生成模型。普通的GAN可以根据标签生成图片，比如&amp;quot;生成一张有胡子的男性照片&amp;rdquo;。但CausalGAN更进一步：它不仅能生成&amp;quot;有胡子的男性&amp;rdquo;，还能生成&lt;strong&gt;干预&lt;/strong&gt;后的结果——比如&amp;quot;给女性&amp;rsquo;强加&amp;rsquo;胡子&amp;rdquo;。&lt;/p&gt;&#xA;&lt;p&gt;听起来像是小事？其实不是。因为标准GAN学习的是&lt;strong&gt;条件分布&lt;/strong&gt;P(胡子|女性)——这几乎没有训练数据，所以生成效果很差。而CausalGAN学习的是&lt;strong&gt;因果关系&lt;/strong&gt;——它知道&amp;quot;胡子&amp;quot;由&amp;quot;性别&amp;quot;和&amp;quot;雄性激素水平&amp;quot;共同决定，而&amp;quot;性别&amp;quot;又是独立的。因此，即使训练数据中几乎没有&amp;quot;留胡子的女性&amp;rdquo;，CausalGAN也能通过因果图生成合理的结果。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;2. 精准医疗中的因果森林&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;2016年，Athey和Imbens开发了&amp;quot;因果树&amp;quot;（Causal Tree），后来扩展到&amp;quot;因果森林&amp;quot;。它解决的问题是：&lt;strong&gt;&amp;ldquo;谁最需要这个治疗？&amp;rdquo;&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;传统AI会问：&amp;ldquo;这个药有效吗？&amp;quot;——得到一个平均效果。但因果森林会问：&amp;ldquo;对哪些人有效？对哪些人无效？&amp;rdquo; 它通过递归分割，自动发现不同子群体的因果效应差异。在实际应用中，这可能意味着：同一个药物，对年轻女性有效但对老年男性无效，因果森林能自动识别出来。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;3. 双重机器学习&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;2018年，Chernozhukov团队提出了双重机器学习（DML），核心思想简单又深刻：当你想估计一个因果关系时，先用机器学习把&amp;quot;已知的干扰因素&amp;quot;的影响剥离掉，再在&amp;quot;剩下的纯净信息&amp;quot;中估计因果效应。&lt;/p&gt;&#xA;&lt;p&gt;这就像做化学实验——先过滤掉杂质，再测量目标的浓度。DML保证了，即使你用了黑箱般的深度学习模型来做&amp;quot;过滤&amp;rdquo;，最后得到的因果估计依然是有统计保证的。&lt;/p&gt;&#xA;&lt;h2 id=&#34;四为什么这很重要从有用到可信&#34;&gt;四、为什么这很重要：从&amp;quot;有用&amp;quot;到&amp;quot;可信&amp;quot;&lt;/h2&gt;&#xA;&lt;p&gt;2024年到2026年，AI领域最显著的变化之一，就是&lt;strong&gt;从&amp;quot;规模&amp;quot;转向&amp;quot;可靠&amp;quot;&lt;/strong&gt;。&lt;/p&gt;&#xA;&lt;p&gt;大模型能写诗、能编程、能陪聊，但它们仍然会&amp;quot;幻觉&amp;quot;——编造不存在的事实。为什么？一个重要原因就是：它们不懂因果。它们只知道&amp;quot;这个词经常出现在那个词后面&amp;quot;，但不知道&amp;quot;为什么这个词应该出现在这里&amp;quot;。&lt;/p&gt;&#xA;&lt;p&gt;如果AI学会了因果推理：&lt;/p&gt;&#xA;&lt;ul&gt;&#xA;&lt;li&gt;&lt;strong&gt;推荐系统&lt;/strong&gt;不会因为&amp;quot;你买了冰激凌&amp;quot;就推荐&amp;quot;游泳装备&amp;quot;，而是会理解背后的真正需求&lt;/li&gt;&#xA;&lt;li&gt;&lt;strong&gt;医疗诊断&lt;/strong&gt;不会把&amp;quot;相关性&amp;quot;当作&amp;quot;病因&amp;quot;，减少误诊&lt;/li&gt;&#xA;&lt;li&gt;&lt;strong&gt;自动驾驶&lt;/strong&gt;能理解&amp;quot;如果这辆车突然刹车，后面的车会怎样反应&amp;quot;——这是反事实推理&lt;/li&gt;&#xA;&lt;li&gt;&lt;strong&gt;科学发现&lt;/strong&gt;能从观测数据中提出因果假设，加速研究&lt;/li&gt;&#xA;&lt;/ul&gt;&#xA;&lt;p&gt;更重要的是，因果推断让AI变得&lt;strong&gt;可解释&lt;/strong&gt;。如果AI说&amp;quot;因为A导致了B，所以我推荐做C&amp;quot;，我们可以检查它的因果图，看推理是否合理。而如果AI说&amp;quot;根据历史数据，过去这样做有效&amp;quot;，我们就无法知道它是否只是&amp;quot;运气好&amp;quot;找到了相关性。&lt;/p&gt;</description>
			</item>
	</channel>
</rss>
