AI 回答中的 Reddit、论坛与 UGC
把 AI 回答下面的引用列表看上一阵,一个规律就出现了:Reddit 的帖子、Stack Exchange 的回答、小众论坛的发言。这不是道听途说,而是测量出来的。Pew Research Center 对 900 名美国成年人真实浏览数据的分析发现,Wikipedia、YouTube 和 Reddit 是 Google AI 摘要中最常被引用的来源,三者合计占所列全部来源的 15%。一条由陌生人写成的帖子,常常就是引擎选择引用的东西,而不是任何一家公司的页面。原因是结构性的,它们也决定了一个品牌能对此做些什么有用的事。
为什么社区内容被引用得这么多
对话式的查询匹配对话式的内容
人们向答案引擎提问的方式,和向一个人提问一样:某样东西值不值、别人实际在用什么、他们出过什么问题。一个论坛帖子本来就是这种形态。标题里是一个问题,下面是第一人称的回答,包括彼此不同意的声音。当引擎检索段落来为一条对话式查询的回答接地时,一个字面上就是围绕该查询展开的对话的页面,是很容易的匹配。而一个写成功能清单的产品页不是。
内容授权交易
引擎不只是在抓取这些内容。它们在为此付钱。路透社在 2024 年 2 月报道,Reddit 达成了一项协议,让它的内容可用于训练 Google 的 AI 模型,据一位熟悉该协议的消息人士称,价值约为每年 6000 万美元。2024 年 5 月,OpenAI 宣布与 Reddit 建立合作关系,使其可以访问 Reddit 的 Data API,公告中把这些内容描述为实时、结构化且独一无二的内容,同时 OpenAI 也成为 Reddit 的广告合作伙伴。有合同、付过费的访问意味着社区内容有一条通往回答的保证路径。这不是当前模型的一个怪癖,下一次更新不会把它去掉。
时效性与第一手经验
论坛帖子承载着新近的、第一人称的报告:上一次更新之后什么坏了、客服如何回应、一件产品用了六个月是什么感觉。奖励可展示的第一手经验的系统,也就是 E-E-A-T 详解中讲到的那些,正好偏爱这类材料。一条上周由产品拥有者写下的帖子,提供了打磨得再好的营销页面也拿不出的证据。
这对一个品牌意味着什么
你客户的问题,正在被别人的帖子回答。有三种回应是正当的:
- 去你的市场真正在交谈的地方出现。用真实账号,公开披露关联关系,对真实问题给出真实回答。一位员工用标明公司身份的账号写下有用、诚实的回复,这叫参与。同样的话出自一个未披露身份的账号,就是垃圾信息,社区也会当作垃圾信息处理。
- 发布帖子里缺的东西。社区回答强在经验,弱在数据。原创数字、测试结果和第一手文档,能给引擎一个理由在引用那些帖子的同时也引用你,而不是只引用帖子。实操手册在如何被 AI 引擎引用中。
- 监测哪些帖子被引用。如果一个引擎总是用三个特定的帖子来为你所在品类的回答接地,你应该知道这件事,因为那些帖子正在塑造买家听到的内容。如何在不自欺的前提下采样,在诚实衡量 AI 搜索可见性中。
为什么制造出来的评论会适得其反
一旦社区引用变得显眼,兜售捷径的服务就出现了:在相关帖子里自动或付费发布提及你产品的评论。这在它自己的逻辑上就站不住。未披露的推广式投放违反 Reddit 的规则,该规则要求用户在自己有切身利益的社区里真实地参与,并禁止垃圾信息和内容操纵。未披露的广告在许多司法辖区也违反消费者保护规定。实际发生的顺序是可预料的:版主删掉评论,社区标记这些账号,而一个被删掉的帖子会把你的提及一起带走。Reddit 的 karma 和账号年龄让看起来可信的投放变得昂贵,而相关的讨论文化很擅长把它识别出来。更宏观的一点,也就是提及只有在别人自愿做出时才有帮助,在AI 回答中的品牌提及与声量占比中讲到。
诚实的小结
AI 回答中的社区引用是真实的,也有充分记录。原因是结构性的:对话式查询检索对话式内容,引擎为这些数据付过费,而第一手报告承载着营销页面所缺的证据。正当的回应是以自己的名义参与,并发布帖子里缺失的实质内容。花钱请人播种评论,买到的是可被删除的内容,而且放在一个专门用来识破它的地方。