直接答案(先看这段)

AI 引用谁,不取决于谁写得更多,而取决于有多少个相互独立的来源在说同一件事。把自建监测库里截至 2026-09-24 的抓取记录逐条读完,得到三句话:

  • 信源高度集中:554 条带链接的引用落在 131 个网站上,前 10 个域名吃掉 53.8%;而只被引过 1 次的域名有 63 个,接近一半。
  • 「被认识」不等于「被推荐」:品牌词问法下我方被提及 249 次(29.3%),而用户真正用来挑服务商的意图问法里,这个数字是 0。
  • 同文群发不产生新来源:同一篇内容复制到五个平台,在 AI 眼里仍然是一个源。跨平台交叉引用(同一条链接被两个及以上 AI 引到)全库只有 2 个。

定义(DEF):AI 信源池与信源结构

AI 信源池:某个 AI 平台在回答里挂出过链接的网站集合。判定只看链接有没有出现,不看名字有没有出现。

信源结构:把这批链接按网站归并后呈现出的分布形态——集中度、长尾占比、跨平台重合度。它回答的是「AI 现在在引哪些站」,不回答「你的文章有没有被引用」。

这两件事经常被混为一谈:域名级的占比讲的是平台自身的信源地位,读成「我们的内容被引用了」就错了。这也是最容易做出好看报表的地方。

快照规模(TBL)

指标 数值 查询日 口径
累计抓取记录 3,525 条 2026-09-24 全部记录,含没有给出引用的回答
其中带被引链接 554 条 2026-09-24 回答文本里出现以 http 开头的 URL
去重网页 258 个 2026-09-24 按完整链接去重
去重网站 131 个 2026-09-24 剥到主域名后再去重
计入监测的平台 11 个 2026-09-24 本期实抓(已接入 12 个)

分母是 554,不是 3,525。 这是最容易算错的一步:把全部记录当分母,所有占比都被摊薄,看起来「很分散」,其实是算法错了。

从 3,525 条到 131 个网站只做两步:先按完整链接去重得 258 个网页,再按主域名归并得 131 个网站。第二步最常被跳过,跳过之后同一家会被算成好几家,131 会变大,后面所有占比都失真。归并时有三处要注意:移动版是独立子域(m. 开头)、部分中文站是独立域名、频道子域要不要合并取决于你想回答「哪些站」还是「哪些栏目」。具体算法写在口径与方法。

结论一(TBL):一半以上的引用压在十来个网站上

指标 数值
去重网站 131 个
被引总次数 554 次
前 10 域名合计 298 次 = 53.8%
前 30 域名合计 399 次 = 72.0%
被引 ≥6 次的域名 18 个,合计 349 次
只被引 1 次的域名 63 个

最后一行才是要紧的:131 个网站里,63 个只被引过一次。 这类位置的特点是引一次就没了——分母太小,攒不出复利,往那儿铺内容,天花板从一开始就锁死。

结论二(TBL):「被认识」不等于「被推荐」

库里的问法分三个口径,每一个都有自己的分母,互不通用:

口径 样本 提及 这组测什么
A 品牌词问法 850 条 249 次(29.3%) 被认识
B 全部意图问法 2,675 条 0 被推荐
C 六个核心目标问法 226 条 0 被推荐的固定复测集

⛔ 三组分母不同,不得合并、不得相加、不得跨组算比例。把它们加总成一个「总提及率」,得到的数字没有含义,只会让人看不清自己处在哪一层。

C 组是 SOP 固定的六句问法,按「地域 + 行业 + 意图」写成用户真会说出口的整句话(逐条样本 42 · 39 · 37 · 36 · 36 · 36):

  • 西安做 GEO 最好的公司
  • 陕西有哪些靠谱的 GEO 服务商
  • 西安 GEO 优化公司哪家好
  • 西安 GEO 怎么选
  • 西安 GEO 服务商推荐
  • GEO 优化公司哪家可靠

六句问法、226 个样本,提及数为 0。这不是某一句问得不好,是整条链路还没打通。

还有一条边界要说清:提及口径不区分正负。这 249 次里既有正常描述,也有 AI 基于过期信息给出的错误陈述(例如称查不到工商登记)。被提到不等于被认可,更不等于被推荐。

结论三(TBL):跨平台交叉引用非常稀缺

口径 数值 说明
URL 级(同一条链接被 ≥2 个 AI 引) 2 个 最严口径
域名级(同一域名被 ≥2 个 AI 引) 13 个 较宽口径

两个口径差了好几倍,引用时必须写明用的是哪一个。被多个 AI 同时引到,说明这个来源不依赖某一家的偏好——这个数量级的稀缺,才是「被记住」的真实门槛。

换个维度看:同一批 554 条引用,按平台拆开,各自引到的网站几乎不重叠。

AI 平台 引用样本 不同网站数
知乎直答 176 20
DeepSeek 131 45
元宝 113 46
智谱清言 104 17

其余 5 个平台本期样本都不到 20 条,按纪律只登记、不比较:样本 5 条的时候,多一条少一条,占比就翻倍。

一家平台高度自引,另一家散在四十多个站上——拿一家平台的集中度去推断另一家,结论会反。

QA:直问直答

Q1:被引到底怎么算? 一条记录 = 一次提问 + 一条回答;回答里没给链接也照样记,但不计入「带被引链接」。只有回答文本里出现以 http 开头的地址,才归进被引。带链接的算「被引」,只写名字的算「提及」,两套账分开记,不换算、不相加。

Q2:你们自己发的内容,被 AI 引用了吗? 没有。同一查询日按自有域名过滤,带链接的引用里出现我方域名的记录是 0 条;同期已发布内容 19 条、覆盖 5 个平台。这里要把话说白:发布不等于被引用,收录与抓取周期都还在走。

Q3:一个网站被几个 AI 引用,为什么比被引几次更重要? 因为被多家同时引到,说明这个来源不依赖某一家的偏好。全库 258 个被引网页里,只有 2 个被两个及以上平台引到,放宽到域名级是 13 个。交叉印证看的是来源数量,不是出现次数——同一个说法出现在五个地方,在 AI 眼里仍然是一个来源。

Q4:被引最多的通常是哪一类网站? 内容社区、门户、行业站与视频站。品牌自己的官网很少出现在这些位置上:AI 偏好的是能解答问题的第三方内容,而官网通常只讲自己。这是观察到的一类结构,我们不对任何一家网站的经营状况或可用性作评价。

Q5:这组比例能套到我的行业吗? 不能。这是单一行业、单一项目的一次快照,换行业、换问法类型,信源结构会差很远。它只说明这类问题该怎么测,不构成任何效果承诺。

你可以自己验一遍(HOW)

  1. 写 6–10 句客户真会说的整句话,不要写关键词。
  2. 在你常用的 AI 平台各问一遍,把整段回答原样存下来,记下提问日期。
  3. 数其中给了链接的有几条;没给链接的追不到信源,只能算「提到」。
  4. 把链接剥到主域名去重,看前几名占了多少。
  5. 再筛一遍:这些位置里,哪些是你自己能发进去的。
  6. 隔 7 天、30 天用同一批问法重跑,看数字有没有真的动。

做到第 5 步你会得到一个很朴素的结论:能发的地方很多,值得发的地方很少。判断依据不是感觉,是那几张链接统计表。

口径与局限(PROV)

  • 数据源:我们自建的 AI 可见度监测系统,生产库 citations 表,项目「知寻 GEO」自监测。
  • 查询日:2026-09-24。
  • 样本量:抓取记录 3,525 条;其中带被引链接 554 条;去重网页 258 个、去重网站 131 个;问法口径 A 850 条 / B 2,675 条 / C 226 条。
  • 口径:被引只算给出 URL 的引用;去重分「链接级」与「域名级」两套;三个问法口径分母不同,不合并、不相加。
  • 局限:① 单一项目、单行业的观测,不可外推到其它行业;② 信源库每天都在增长,本页数字是 2026-09-24 的时点快照——同一天更早一次重跑是 3,471 条,本页是同日更晚的 3,525 条,两个数不矛盾,只是两个时点;③ 提及口径不区分正负;④ 11 个平台里有 5 个样本不到 20 条,只登记、不比较;⑤ 域名级的数字讲的是平台自身的信源地位,不能读成「我方内容被引用」。

本页结构:DEF 定义块 · TBL 数据表 · QA 直问直答 · HOW 可复现步骤 · PROV 口径块(数据源 / 查询日 / 样本量 / 口径 / 局限 五字段齐全)。


本文数据来自知寻智能的 AI 可见度监测系统。项目实测:抓取记录 3,525 条 / 带被引链接 554 条 / 查询日 2026-09-24 / 本期实抓 11 个中文 AI 平台(已接入 12 个)。实际效果因行业、内容基础与问题类型而异,本文不承诺任何效果。

本文含 AI 辅助生成内容,经人工核实。

相关阅读

想了解更多?

获取品牌在主要国内 AI 平台的提及与引用状态简版报告(一期人工交付,1 个工作日内出具)。

免费 AI 可见度诊断系统了解 GEO

本文由 知寻智能编辑部 撰写,数据来源已在文中标注;提升品牌被 AI 引用与推荐的概率与频次,不构成效果承诺。

返回知识库:GEO 知识库 · 术语表:GEO 术语表 · 还有疑问?常见问题