Schema.org:搜索引擎共建的结构化数据词汇表
Schema.org是Google、微软、Yahoo于2011年共同发起(Yandex随后加入)的结构化数据词汇表项目,定义Organization、Article、FAQPage等数千个类型与属性,是网页向搜索引擎与AI声明实体含义的公共语言,也是GEO实体层部署的词汇基础。
词条定义(Schema.org)
Schema.org是Google、微软、Yahoo于2011年共同发起(Yandex随后加入)的结构化数据词汇表项目,定义Organization、Article、FAQPage等数千个类型与属性,是网页向搜索引擎与AI声明实体含义的公共语言,也是GEO实体层部署的词汇基础。
Schema.org是Google、微软、Yahoo于2011年共同发起(Yandex随后加入)的结构化数据词汇表项目,定义Organization、Article、FAQPage等数千个类型与属性。没有公共词汇表时各引擎各搞一套标记,站点无法兼顾;Schema.org统一类型定义后一次部署多方受益,已成结构化数据事实标准,是GEO实体层部署的词汇基础。
机制
词汇表以类型层级组织:Thing为根类型,Organization、Person、Place、CreativeWork等一级类型向下派生Corporation、LocalBusiness、Article等子类型,属性定义其合法取值域与值类型。页面数据按类型实例化后,引擎将其与自身知识图谱对齐理解;类型选得越精确,实体消解的歧义越小,品牌被准确关联的概率越高。
词汇与格式解耦:Schema.org只定义语义,承载格式可以是JSON-LD、Microdata或RDFa。对GEO而言JSON-LD优先,因其部署独立于页面结构、维护成本低、对无渲染爬虫友好;同一页面多格式混用时需保证语义一致,避免重复或矛盾声明导致引擎弃用数据。
词汇表通过公开社区流程演进:新类型提案在官方GitHub讨论,确认后随版本发布,各搜索引擎自行决定支持范围。据公开报道,围绕AI场景的词汇扩展讨论持续推进,站长应关注版本更新与引擎支持清单,优先使用已被广泛支持的成熟类型,自造属性名引擎会直接忽略。
落地方法
- 优先使用官方定义的成熟类型而非自造属性
- 按页面性质选择最精确类型,Article优于泛用WebPage
- 关注schema.org版本更新与搜索引擎支持清单
- 复杂关系用@id与@graph组织多实体网络
- 全站统一类型选型标准并写入开发规范
- 用Schema校验工具检查词汇使用的合法性
- 新页面发布流程中纳入结构化数据校验环节
常见误区
- 滥用不相关类型骗取富结果展示,被判垃圾标记
- 类型选择过泛,实体理解模糊影响知识图谱对齐
- 自造词汇表外的属性名,引擎直接忽略
- 同一实体在不同页面属性矛盾,置信度互相抵消
相关词条:JSON-LD、知识图谱、Organization Schema