<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
	<channel>
		<title>用户画像 on 灵语AI</title>
		<link>https://lingyu7.com/tags/%E7%94%A8%E6%88%B7%E7%94%BB%E5%83%8F/</link>
		<description>Recent content in 用户画像 on 灵语AI</description>
		<generator>Hugo</generator>
		<language>zh-CN</language>
		
		
		
		
			<lastBuildDate>Sat, 01 Aug 2026 02:29:00 +0800</lastBuildDate>
		
			<atom:link href="https://lingyu7.com/tags/%E7%94%A8%E6%88%B7%E7%94%BB%E5%83%8F/index.xml" rel="self" type="application/rss+xml" />
			<item>
				<title>你刷抖音时，AI真的懂你吗？——推荐系统背后的统计魔法</title>
				<link>https://lingyu7.com/posts/does-ai-really-understand-you-recommendation-system/</link>
				<pubDate>Sat, 01 Aug 2026 02:29:00 +0800</pubDate>
				<guid>https://lingyu7.com/posts/does-ai-really-understand-you-recommendation-system/</guid>
				<description>&lt;h2 id=&#34;引言一个经典的细思极恐时刻&#34;&gt;引言：一个经典的&amp;quot;细思极恐&amp;quot;时刻&lt;/h2&gt;&#xA;&lt;p&gt;你刚和朋友聊完某样东西，打开手机App，发现推荐页上赫然出现了它。&lt;/p&gt;&#xA;&lt;p&gt;这一刻，你可能会觉得毛骨悚然——&amp;ldquo;手机在监听我&amp;rdquo;。&lt;/p&gt;&#xA;&lt;p&gt;但真相比这更微妙，也更值得玩味。&lt;strong&gt;推荐系统大概率没有在监听你的对话&lt;/strong&gt;——它只是通过你的行为数据，推测出了你此刻可能感兴趣的东西。而它之所以能&amp;quot;猜中&amp;quot;，靠的不是读心术，而是一个简单到令人惊讶的统计技巧。&lt;/p&gt;&#xA;&lt;p&gt;更扎心的是：这个技巧和&amp;quot;理解你&amp;quot;几乎没有关系。它只是发现了你和其他人之间的&amp;quot;模式相似性&amp;quot;。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;一推荐系统的原始版本买了这个的人也买了那个&#34;&gt;一、推荐系统的&amp;quot;原始版本&amp;quot;：买了这个的人也买了那个&lt;/h2&gt;&#xA;&lt;p&gt;故事要从电商说起。&lt;/p&gt;&#xA;&lt;p&gt;2003年，亚马逊的工程师们面临一个现实问题：Amazon上有几千万用户和几亿件商品，如何给每个用户推荐他们可能感兴趣的东西？&lt;/p&gt;&#xA;&lt;p&gt;当时的推荐算法有两种主流思路：&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;第一种：找&amp;quot;和你相似的人&amp;quot;（User-based协同过滤）。&lt;/strong&gt; 如果你和另外100个人的购物历史高度重合，那这100个人买了但你还没买的东西，很可能也是你想要的。这个思路听起来很合理，但有一个致命问题——计算&amp;quot;用户之间的相似度&amp;quot;需要遍历所有用户，当用户量达到几千万时，这个计算量会爆炸。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;第二种：找&amp;quot;和这个商品相似的商品&amp;quot;（Item-based协同过滤）。&lt;/strong&gt; 亚马逊提出的方案是：&lt;strong&gt;不比较用户，只比较商品。&lt;/strong&gt; 如果买了A的用户中，有很大比例也买了B，那就说A和B&amp;quot;相似&amp;quot;——下次有人买A时，就推荐B。&lt;/p&gt;&#xA;&lt;p&gt;这个思路的精妙之处在于：&lt;strong&gt;商品的数量远少于用户的数量&lt;/strong&gt;（至少在当时如此），所以计算&amp;quot;商品之间的相似度&amp;quot;比计算&amp;quot;用户之间的相似度&amp;quot;快得多。而且商品之间的关系相对稳定——今天&amp;quot;手机和手机壳&amp;quot;是搭配的，明天大概率还是。&lt;/p&gt;&#xA;&lt;p&gt;亚马逊把这个方法落地后，效果出奇的好。直到今天，你打开淘宝看到的&amp;quot;买了这个的人也买了那个&amp;quot;，本质上还是这个思路的变种。&lt;/p&gt;&#xA;&lt;p&gt;但问题来了：&lt;strong&gt;这个方法真的&amp;quot;理解&amp;quot;你了吗？&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;想象一下，你买了一部手机，但没买手机壳，因为你觉得太贵了。推荐系统告诉你&amp;quot;买了手机的人也买了手机壳&amp;quot;——它给出了一个看似&amp;quot;合理&amp;quot;的推荐，但对你来说，这个推荐恰恰是你不想要的。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;推荐系统不知道你为什么不买手机壳。它只知道&amp;quot;很多人同时买了这两样东西&amp;quot;。&lt;/strong&gt; 它捕获的是统计共现，不是因果理解。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;二从猜你喜欢到让你上瘾推荐系统如何进化&#34;&gt;二、从&amp;quot;猜你喜欢&amp;quot;到&amp;quot;让你上瘾&amp;quot;：推荐系统如何进化&lt;/h2&gt;&#xA;&lt;p&gt;2003年的协同过滤虽然好用，但有一个明显的缺陷：&lt;strong&gt;它只能推荐&amp;quot;看起来像你已经买过的&amp;quot;东西。&lt;/strong&gt; 它无法发现你&amp;quot;潜在的可能喜欢但从未接触过&amp;quot;的东西。&lt;/p&gt;&#xA;&lt;p&gt;这就好比一个图书管理员，只推荐你&amp;quot;借过这本书的人也借了那本书&amp;quot;——但如果你从未借过科幻小说，他永远不会推荐你任何科幻作品，即使你可能会喜欢。&lt;/p&gt;&#xA;&lt;p&gt;2016年，Google的工程师们提出了一个更聪明的方案：&lt;strong&gt;Wide &amp;amp; Deep（宽深模型）。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;这个名字听起来很技术，但它的核心思想其实很简单：&lt;strong&gt;&amp;ldquo;记忆&amp;quot;和&amp;quot;泛化&amp;quot;要配合使用。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;ul&gt;&#xA;&lt;li&gt;&lt;strong&gt;&amp;ldquo;记忆&amp;quot;部分&lt;/strong&gt;：记住那些已经被验证过的组合——比如&amp;quot;喜欢iPhone的人通常也喜欢AirPods&amp;rdquo;。这部分和2003年的协同过滤类似，但做得更精细。&lt;/li&gt;&#xA;&lt;li&gt;&lt;strong&gt;&amp;ldquo;泛化&amp;quot;部分&lt;/strong&gt;：学习用户行为的&amp;quot;深层模式&amp;rdquo;——比如&amp;quot;喜欢简约设计手机的人，可能也喜欢简约设计的耳机、手表、甚至家具&amp;rdquo;。这部分通过深度学习实现，可以从用户的行为数据中&amp;quot;归纳&amp;quot;出用户看不见的偏好。&lt;/li&gt;&#xA;&lt;/ul&gt;&#xA;&lt;p&gt;这个模型在Google Play商店上线后，App购买率提升了3.9%。这个数字听起来不大，但放在Google Play的体量上，意味着&lt;strong&gt;每天多出数百万次应用下载&lt;/strong&gt;。&lt;/p&gt;&#xA;&lt;p&gt;从此，推荐系统从&amp;quot;猜你喜欢&amp;quot;进化到了&amp;quot;创造你喜欢&amp;quot;——它不再只是推荐你已知的东西，而是开始&lt;strong&gt;引导你的偏好&lt;/strong&gt;。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;三但ai真的懂你吗&#34;&gt;三、但AI真的&amp;quot;懂&amp;quot;你吗？&lt;/h2&gt;&#xA;&lt;p&gt;到这里，我们似乎已经有一个很强大的推荐系统了——它既记得住你的历史偏好，又能发现你潜在的兴趣。听起来像是&amp;quot;很懂你&amp;quot;，对吧？&lt;/p&gt;&#xA;&lt;p&gt;但让我们停下来想想：&lt;strong&gt;推荐系统学到的&amp;quot;你&amp;quot;，和真实的&amp;quot;你&amp;quot;，有多大的差距？&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;差距一：你的行为不是你。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;你点开了一个视频，可能不是因为喜欢，而是因为封面太夸张。你买了某件商品，可能不是因为需要，而是因为打折。你收藏了一篇文章，可能不是因为想读，而只是因为&amp;quot;先马后看&amp;quot;。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;但推荐系统不知道这些区别。&lt;/strong&gt; 它只知道&amp;quot;你点了&amp;quot;、&amp;ldquo;你买了&amp;rdquo;、&amp;ldquo;你收藏了&amp;rdquo;——它把你的行为当成了你的偏好。推荐系统建立一个&amp;quot;你&amp;quot;的模型，但这个模型只是你行为的统计学投影，不是你真实的内心。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;差距二：相关性不等于因果性。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;推荐系统的核心假设是&amp;quot;过去的行为能预测未来的偏好&amp;quot;——但这个假设有一个巨大的漏洞：&lt;strong&gt;相关性不等于因果性。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;你喜欢看推理小说，可能不是因为&amp;quot;推理&amp;quot;这个标签，而是因为&amp;quot;喜欢解谜的感觉&amp;quot;。但推荐系统只知道&amp;quot;你买了推理小说&amp;quot;这个行为，于是它给你推荐更多推理小说，而忽略了也许你也会喜欢数学谜题、密室逃脱、甚至悬疑类游戏。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;推荐系统在&amp;quot;行为的表面&amp;quot;上构建偏好模型，却没有触及&amp;quot;行为背后的动机&amp;quot;。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;差距三：你看到的，只是&amp;quot;你&amp;quot;的某一个侧面。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;推荐系统会根据你的最近行为，动态调整推荐策略。你今天搜了&amp;quot;考研&amp;quot;，明天整个App就变成了考研资料库；你今天看了几条搞笑视频，后天首页全是搞笑内容。&lt;/p&gt;&#xA;&lt;p&gt;这不是&amp;quot;AI懂你&amp;quot;，而是&lt;strong&gt;AI把你的某一个行为放大成了你的全部画像&lt;/strong&gt;。它不像一个了解你的朋友，而像一个只看了你最近几条朋友圈就来下结论的陌生人。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;四推荐系统真正在做的事&#34;&gt;四、推荐系统真正在做的事&lt;/h2&gt;&#xA;&lt;p&gt;所以，推荐系统到底在做什么？&lt;/p&gt;&#xA;&lt;p&gt;答案是：&lt;strong&gt;它不是在做&amp;quot;心理学&amp;quot;，而是在做&amp;quot;统计学&amp;quot;。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;它不关心你&amp;quot;为什么&amp;quot;喜欢某样东西，它只关心&amp;quot;和其他人相比，你表现出了哪些相似的行为模式&amp;quot;。它的核心逻辑是：&lt;/p&gt;&#xA;&lt;blockquote&gt;&#xA;&lt;p&gt;如果你和A组用户有80%的行为重合，那么A组用户剩下的20%行为，大概率也是你想要的。&lt;/p&gt;&#xA;&lt;/blockquote&gt;&#xA;&lt;p&gt;这是一个纯粹的&amp;quot;模式匹配&amp;quot;过程。它不需要理解你的情感、动机、价值观——它只需要发现行为模式之间的相似性。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;这听起来很&amp;quot;机械&amp;quot;，但效果出奇的好。&lt;/strong&gt; 为什么呢？&lt;/p&gt;&#xA;&lt;p&gt;因为人类的行为模式，在统计学层面上，远比我们想象的要稳定和可预测。我们以为自己很独特，但在推荐系统的眼里，你只是&amp;quot;模式123456&amp;quot;的一个实例——你的偏好，已经被无数个和你相似的人&amp;quot;预演&amp;quot;过了。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;五问题不在推荐系统而在于什么被推荐&#34;&gt;五、问题不在推荐系统，而在于&amp;quot;什么被推荐&amp;quot;&lt;/h2&gt;&#xA;&lt;p&gt;推荐系统本身没有好坏——它只是一个工具。问题在于它被用来做什么。&lt;/p&gt;&#xA;&lt;p&gt;当推荐系统用来帮你&lt;strong&gt;发现&lt;/strong&gt;新的兴趣时，它是有益的。当它被用来&lt;strong&gt;固化&lt;/strong&gt;你的兴趣时，就变成了&amp;quot;信息茧房&amp;quot;的制造者。&lt;/p&gt;&#xA;&lt;p&gt;你刷抖音时，每点一个&amp;quot;喜欢&amp;quot;，系统就记录下这个信号，然后给你推荐更多类似的内容。久而久之，你看到的永远是你&amp;quot;已经喜欢&amp;quot;的东西，而&amp;quot;可能喜欢但还没见过&amp;quot;的东西，永远没有机会出现。&lt;/p&gt;&#xA;&lt;p&gt;&lt;strong&gt;推荐系统的&amp;quot;泛化&amp;quot;能力，被商业目标收窄了。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;Google的Wide &amp;amp; Deep模型在论文中说&amp;quot;记忆&amp;quot;和&amp;quot;泛化&amp;quot;互补——但在实际应用中，商业平台更倾向于&amp;quot;记忆&amp;quot;（因为已经验证过的推荐能带来更高的点击率），而&amp;quot;泛化&amp;quot;（推荐用户可能不熟悉的内容）往往被压缩到最低限度，因为&amp;quot;冒险&amp;quot;意味着可能流失用户。&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;h2 id=&#34;结语推荐系统的镜像与盲区&#34;&gt;结语：推荐系统的&amp;quot;镜像&amp;quot;与&amp;quot;盲区&amp;quot;&lt;/h2&gt;&#xA;&lt;p&gt;下次你打开淘宝或抖音，看到&amp;quot;猜你喜欢&amp;quot;的推荐时，可以想一想：你看到的不是&amp;quot;AI眼中的你&amp;quot;，而是&lt;strong&gt;AI根据你的行为数据，重建出的一个统计学模型&lt;/strong&gt;。&lt;/p&gt;&#xA;&lt;p&gt;这个模型很精准，但它有一个盲区——它永远无法理解&amp;quot;你为什么喜欢&amp;quot;。&lt;/p&gt;&#xA;&lt;p&gt;它知道你喜欢看推理小说，但不知道你是因为喜欢解谜、还是因为喜欢悬疑氛围、还是因为这本小说是朋友推荐的。它只告诉你&amp;quot;你喜欢的&amp;quot;，但不告诉你&amp;quot;你为什么喜欢&amp;quot;。&lt;/p&gt;&#xA;&lt;p&gt;而这，恰恰是推荐系统下一步进化的方向——从&amp;quot;猜你喜欢什么&amp;quot;到&amp;quot;理解你为什么喜欢&amp;quot;。当AI开始追问&amp;quot;为什么&amp;quot;的时候，推荐系统才真正从&amp;quot;统计魔法&amp;quot;走向&amp;quot;认知理解&amp;quot;。&lt;/p&gt;</description>
			</item>
	</channel>
</rss>
