结构化数据:schema 到底能给你带来什么
结构化数据是对页面内容的一种机器可读描述,与可见内容并列添加在页面上。Google 把它定义为一种标准化格式,用来提供关于页面的信息并对页面内容进行分类。词汇表来自 schema.org,而 Google 推荐的格式是 JSON-LD:一小段 script 块,里面是一个 JSON 对象,用直白的字段说明这个页面是一篇文章,带有某个标题、作者和日期,或者是一件商品,带有某个价格和库存状态。因为它独立成块,而不是编织进 HTML 里,JSON-LD 是最容易生成、模板化并大规模维护的格式。
schema 驱动的富媒体搜索结果
结构化数据的价值体现在传统的 Google Search 里,它让页面有资格获得富媒体搜索结果:比标题和摘要展示更多内容的增强型条目。根据 Google 的结构化数据文档,这些标记的意义正是在于这些功能:
- 商品摘要。价格、库存状态和评价星级直接显示在搜索结果里。对商店来说这是最有价值的富媒体搜索结果,它与本地与商家数据中讲到的 Merchant Center 数据 feed 相互配合。
- 文章标记。标题、作者和日期信息,帮助 Google 在各个搜索界面上正确呈现新闻和博客内容。
- 菜谱、活动、招聘信息和面包屑导航。每一种都有自己的标记类型、自己的必填字段和自己的资格规则。
这里有一个值得警惕的例子。FAQ 富媒体搜索结果曾经是热门的优化目标,2023 年 8 月被限制为只对知名、权威的政府和健康类网站开放,2026 年 Google 又把这项功能从 Search 中彻底下线。教训是普遍适用的:标记买来的是获得某项功能的资格,从来不是保证,而功能是可以被撤回的。在投入任何一种标记类型之前,先查看当前的文档。
验证
标记只有能被解析才算数。Google 的富媒体搜索结果测试会检查页面的结构化数据是否让它有资格获得 Google 的各项功能,并能预览其中一部分。Schema Markup Validator 检查通用的 schema.org 语法,不带 Google 专属的那一层。上线之后,Search Console 里的富媒体搜索结果状态报告会显示页面是否保住了资格。有一条规则凌驾于所有工具之上:标记必须描述页面上真实可见的内容。承诺了页面并未展示的东西的标记会被当作垃圾内容处理。
一个诚实的界限:AI 搜索并不需要它
Google 在这一点上毫不含糊。它的 AI 功能指南写明,生成式 AI 搜索并不需要结构化数据,也不存在什么必须添加的特殊 schema.org 标记。AI 概览和 AI 模式是通过接地(用检索到的内容作为事实依据)于常规排名系统的检索来挑选来源的,真正的准入条件是页面已编入索引并具备摘要资格,这一点在摘要资格中讲到。任何把 schema 当作直接影响 AI 回答的杠杆来兜售的人,都是在跟 Google 自己的文档唱反调。
什么时候仍然值得投入
在传统功能仍然带来回报的地方,schema 依然值得做。如果你卖商品,商品标记加上 Merchant Center 数据 feed 会把价格和库存状态放进搜索结果里。如果你发布文章,文章标记在发布时成本很低,并且让作者署名和日期保持机器可读。Vupie 在它发布的每个页面上都包含文章 schema,正是出于这个原因。同样清楚的是该跳过什么:像 FAQ 这样已经下线的功能,以及任何描述了页面并未可见地包含的内容的标记。把 schema 当作富媒体搜索结果的廉价保险,而不是 AEO 的捷径。