直接答案(先看这段)
结论:官网能否被 AI 引用,可按 6 类 / 12 项加权检查自查,后文逐项给出合格线。先修可访问性与正文,再补技术项。
为什么这些项和「被引用」有关
AI 给出带引用的答案分三步:先检索、再评估、后生成,官网的每一项检查都落在其中一步上。
- 检索:AI 引擎从索引库中找出与问题相关的网页,内容语义清晰、结构规范才容易被命中。
- 评估:对候选内容按可信度与匹配度排序,权威引用、数据佐证、来源标注都会提升可信权重。
- 生成:把筛选后的信息组织成自然语言答案并标注引用,结论前置、问答式结构的内容更容易成为答案素材。
所以下面这 12 项不是「SEO 体检表换了个名字」:它们检查的是官网有没有给 AI 提供可检索的结构、可评估的可信信号,以及可被逐句摘出来的答案素材。
12 项自查清单(含量化权重)
权重合计 100 分,每一项都是「页面级」检查,改完可以立刻复测。建议按权重从高到低修,把时间先花在 15 分档和 12 分档上。
| # | 检查项 | 权重 | 合格线(简述) |
|---|---|---|---|
| 1 | 可访问性 | 15 | 首页返回 HTTP 200–399 |
| 2 | 正文内容充实度 | 15 | 正文 800 字以上,且页面有且仅有一个 H1 |
| 3 | 页面标题 title | 12 | 有 <title>,8 字以上,含品牌与核心业务词 |
| 4 | Schema 结构化标记 | 12 | 页面存在 JSON-LD 或 Microdata |
| 5 | 关键词覆盖 | 10 | 品牌名在正文中出现 |
| 6 | Meta 描述 | 8 | 有 description,50–160 字并含业务关键词 |
| 7 | llms.txt | 6 | 站点声明了 llms.txt(或页面引用它) |
| 8 | AI 爬取许可 | 5 | 首页没有 noindex / nofollow |
| 9 | Canonical | 5 | 页面声明了 rel="canonical" |
| 10 | OG 社交标签 | 4 | 声明了 og:title / og:description / og:image |
| 11 | ICP 备案号 | 4 | 页脚可见 ICP 备案号 |
| 12 | 广告法合规 | 4 | 正文未出现极限词 |
1. 可访问性(15 分):查什么 / 合格线 / 不合格表现
查的是首页能不能被正常抓到。合格线是一条:首页返回 HTTP 200–399(含跳转后的最终页)。不合格的典型表现是超时、连接失败或 5xx——这种情况下整套诊断会直接中断,后面 11 项都没有意义,所以它权重居首,而且必须排在修复顺序的第一位(这一项不通,其余检查都无从谈起)。
2. 正文内容充实度(15 分):查什么 / 合格线 / 不合格表现
查的是首页有没有足够上下文供 AI 摘取。合格线是正文 800 字以上,同时页面有且仅有一个 H1,标题层级不跳级。不合格的典型表现有两类:一是正文不足 500 字,整页只有导航、口号和一段公司简介,AI 找不到可引用的完整句子;二是完全没有 H1,或一页塞了好几个 H1,页面主题无法被确定。
3. 页面标题 title(12 分):查什么 / 合格线 / 不合格表现
查的是浏览器标签与搜索结果里那一行标题。合格线是存在 <title>,长度 8 字以上(建议 8–30 字),并且同时含品牌名与核心业务词。不合格的典型表现是标题为空、只写「首页」、只堆业务词不带品牌名,或长到被截断、品牌名落在截断之外。
4. Schema 结构化标记(12 分):查什么 / 合格线 / 不合格表现
查的是页面有没有机器可读的实体声明。合格线是能检出 JSON-LD 或 Microdata,常用类型是 Organization、LocalBusiness、FAQPage。不合格的典型表现是整站没有任何结构化数据——H1、正文、联系方式都只以纯文本和视觉样式呈现,AI 只能靠猜来判断「这是哪家公司、做什么、在哪」。
5. 关键词覆盖(10 分):查什么 / 合格线 / 不合格表现
查的是品牌词与行业词在正文里的实际出现情况。合格线以品牌词为先:首页正文至少命中一次品牌名,行业词则用于补充语义范围。不合格的典型表现是首页通篇「我们」「本公司」「本平台」,一次品牌全称都没写;或者只把品牌名放在 logo 图片和标题标签里,正文里搜不到。
6. Meta 描述(8 分):查什么 / 合格线 / 不合格表现
查的是页面摘要。合格线是存在 meta description,长度 50–160 字,含业务关键词,写成一句能独立成立的话。不合格的典型表现是完全没有 description,或内容是从正文里截断的残缺句、只写「欢迎访问本公司网站」这类无信息量的套话。
7. llms.txt(6 分):查什么 / 合格线 / 不合格表现
查的是站点有没有给 AI 模型一份说明文件与推荐路径。合格线是站点声明了 llms.txt,或在页面中引用了它。不合格的典型表现是站点根目录下没有该文件,AI 只能自行猜测哪些页面值得读、哪些是营销页。这一项是目前中文站点缺失比例较高的一项,也是补齐成本最低的一项。
8. AI 爬取许可(5 分):查什么 / 合格线 / 不合格表现
查的是有没有主动挡住抓取。合格线是首页不存在 noindex 或 nofollow 标记,搜索引擎与 AI 爬虫可以正常收录。不合格的典型表现有两种:一是测试环境遗留的 noindex 被带上线,整站被排除在索引之外;二是全局 nofollow 让页面里的引用链全部失效——这两种通常只需要删一行代码。
9. Canonical(5 分):查什么 / 合格线 / 不合格表现
查的是重复页面有没有收敛到唯一地址。合格线是页面声明了 rel="canonical",且指向自身的正式 URL。不合格的典型表现是带参数、带大小写或带 /index.html 的多个版本同时可访问、都声明自己是正主,AI 收录时权重被分散到若干重复页上。
10. OG 社交标签(4 分):查什么 / 合格线 / 不合格表现
查的是页面被分享、被外部引用时有没有摘要与配图。合格线是声明了 og:title / og:description / og:image 三项。不合格的典型表现是分享出去只有一条裸链接,标题和配图由平台自行抓取,外部引用时呈现的信息不受你控制。
11. ICP 备案号(4 分):查什么 / 合格线 / 不合格表现
查的是国内上线的合规硬性项。合格线是页脚可见 ICP 备案号,并且站内可点击跳转到备案查询页。不合格的典型表现是页脚只有版权行没有备案号,或备案号只写在底部图片里、无法被文本提取——这既影响合规,也让 AI 少了一个可核验的主体信息。
12. 广告法合规(4 分):查什么 / 合格线 / 不合格表现
查的是正文里有没有《广告法》明确禁止的绝对化用语(即广告法禁止的排他性表述;为避免在本页复现那些词,这里只作泛指,系统内的检查项会逐条列出)。合格线是正文里一处都没有——包括标题、副标题与表格。这一项同时是内容风险项:AI 引用你的页面时会把原句一起带走,绝对化用语不只影响合规,也会降低内容被当作客观信源采信的可能。
自查完后的修复顺序
按「一次改动能拿下多少分」排序,而不是按问题新旧排序。
- 先修可访问性与爬取许可:这两项不合格时,其余 10 项再完美也没有入口。
- 再修正文与标题:15 分与 12 分档里较费时间的两项,但也是 AI 真正用来作答的素材。
- 然后一次补齐技术项:
llms.txt、Canonical、OG、ICP、Schema 属于一次性配置,做完可长期复测得分不变。 - 最后处理内容项:Meta 描述、关键词覆盖、广告法合规随内容更新反复回归,放进日常发稿的检查环节更省力。
适用边界
这套清单适用于有独立官网、能改前端模板或静态页、且有内容维护能力的品牌方;对四种情况不适用或需要换方法:
- 没有官网、只在第三方平台开店:12 项里的技术项(Schema、Canonical、OG、
llms.txt)你无法控制,应改从平台页面的内容结构入手。 - 官网由外部供应商托管、改不动模板:先把上面的清单作为验收单交给供应商,而不是自己逐项动手。
- 官网只是门面、没有可写的业务内容:正文扩充与关键词覆盖需要真实素材,AI 没有可引用的东西,任何检查表都补不出来。
- 把清单当成效果承诺:这 12 项查的是「官网对 AI 是否友好」,不等于「AI 一定会引用你」。是否被引用还取决于问题类型、行业信源竞争与你内容的其他来源分布,且引用情况本身会随时间变化。
另外,某些 AI 平台本期未纳入我们的实抓范围,因此清单里不含对具体平台收录状态的判断——那属于平台侧行为,不是官网侧能自查的项。
FAQ
Q1:这 12 项我要用工具跑,还是自己一条条手查?
自己就能查完。可访问性、noindex、Canonical、OG、llms.txt 用浏览器开发者工具或查看网页源代码就能确认;正文长度、H1 数量、品牌词出现、极限词用文本搜索即可。需要工具的是批量页面和定期复测——手工查单页够用,站点上百页之后就需要固定一份检查表按周期跑。
Q2:12 项都做到了,是不是就会被 AI 引用? 不是。这 12 项解决的是「AI 能不能读懂、愿不愿意采信」的官网侧前提,被引用还取决于你被问到的问题是否与官网内容对齐、同题下有没有更强信源。官网改好是必要条件,不是充分条件;能确定的是,官网这 12 项不合格时,AI 连读懂都困难。
Q3:llms.txt 权重只有 6 分,还有必要做吗? 值得做,因为它的成本很低。它的作用是给 AI 模型一份站点说明与推荐路径,配置一次即可长期生效;权重低只说明它不是决定性项,不代表可以跳过——12 项里任何一项失分都会直接扣在总分上。
本文引用的 12 项检查与权重来自知寻 GEO 官网诊断模块的公开口径(6 类 / 12 项加权检查,权重合计 100);正文与 H1、Meta 描述、关键词命中等合格线为该系统同口径的判定规则。查询日:2026-09-23。以上均为检查项口径,不是引用效果数据;官网诊断结果反映官网侧对 AI 的友好度,不等于引用效果,实际引用情况因行业、内容基础与问题类型而异;平台口径:知寻 GEO 已接入 12 个中文 AI 平台(本期实抓 11 个)。
想了解更多?
获取品牌在主要国内 AI 平台的提及与引用状态简版报告(一期人工交付,1 个工作日内出具)。
本文由 知寻智能编辑部 撰写,数据来源已在文中标注;提升品牌被 AI 引用与推荐的概率与频次,不构成效果承诺。
