直接答案(先看这段)
AI 引用谁,不取决于谁写得更多,而取决于有多少个相互独立的来源在说同一件事。把自建监测库里截至 2026-09-24 的抓取记录逐条读完,得到三句话:
- 信源高度集中:554 条带链接的引用落在 131 个网站上,前 10 个域名吃掉 53.8%;而只被引过 1 次的域名有 63 个,接近一半。
- 「被认识」不等于「被推荐」:品牌词问法下我方被提及 249 次(29.3%),而用户真正用来挑服务商的意图问法里,这个数字是 0。
- 同文群发不产生新来源:同一篇内容复制到五个平台,在 AI 眼里仍然是一个源。跨平台交叉引用(同一条链接被两个及以上 AI 引到)全库只有 2 个。
定义(DEF):AI 信源池与信源结构
AI 信源池:某个 AI 平台在回答里挂出过链接的网站集合。判定只看链接有没有出现,不看名字有没有出现。
信源结构:把这批链接按网站归并后呈现出的分布形态——集中度、长尾占比、跨平台重合度。它回答的是「AI 现在在引哪些站」,不回答「你的文章有没有被引用」。
这两件事经常被混为一谈:域名级的占比讲的是平台自身的信源地位,读成「我们的内容被引用了」就错了。这也是最容易做出好看报表的地方。
快照规模(TBL)
| 指标 | 数值 | 查询日 | 口径 |
|---|---|---|---|
| 累计抓取记录 | 3,525 条 | 2026-09-24 | 全部记录,含没有给出引用的回答 |
| 其中带被引链接 | 554 条 | 2026-09-24 | 回答文本里出现以 http 开头的 URL |
| 去重网页 | 258 个 | 2026-09-24 | 按完整链接去重 |
| 去重网站 | 131 个 | 2026-09-24 | 剥到主域名后再去重 |
| 计入监测的平台 | 11 个 | 2026-09-24 | 本期实抓(已接入 12 个) |
分母是 554,不是 3,525。 这是最容易算错的一步:把全部记录当分母,所有占比都被摊薄,看起来「很分散」,其实是算法错了。
从 3,525 条到 131 个网站只做两步:先按完整链接去重得 258 个网页,再按主域名归并得 131 个网站。第二步最常被跳过,跳过之后同一家会被算成好几家,131 会变大,后面所有占比都失真。归并时有三处要注意:移动版是独立子域(m. 开头)、部分中文站是独立域名、频道子域要不要合并取决于你想回答「哪些站」还是「哪些栏目」。具体算法写在口径与方法。
结论一(TBL):一半以上的引用压在十来个网站上
| 指标 | 数值 |
|---|---|
| 去重网站 | 131 个 |
| 被引总次数 | 554 次 |
| 前 10 域名合计 | 298 次 = 53.8% |
| 前 30 域名合计 | 399 次 = 72.0% |
| 被引 ≥6 次的域名 | 18 个,合计 349 次 |
| 只被引 1 次的域名 | 63 个 |
最后一行才是要紧的:131 个网站里,63 个只被引过一次。 这类位置的特点是引一次就没了——分母太小,攒不出复利,往那儿铺内容,天花板从一开始就锁死。
结论二(TBL):「被认识」不等于「被推荐」
库里的问法分三个口径,每一个都有自己的分母,互不通用:
| 口径 | 样本 | 提及 | 这组测什么 |
|---|---|---|---|
| A 品牌词问法 | 850 条 | 249 次(29.3%) | 被认识 |
| B 全部意图问法 | 2,675 条 | 0 | 被推荐 |
| C 六个核心目标问法 | 226 条 | 0 | 被推荐的固定复测集 |
⛔ 三组分母不同,不得合并、不得相加、不得跨组算比例。把它们加总成一个「总提及率」,得到的数字没有含义,只会让人看不清自己处在哪一层。
C 组是 SOP 固定的六句问法,按「地域 + 行业 + 意图」写成用户真会说出口的整句话(逐条样本 42 · 39 · 37 · 36 · 36 · 36):
- 西安做 GEO 最好的公司
- 陕西有哪些靠谱的 GEO 服务商
- 西安 GEO 优化公司哪家好
- 西安 GEO 怎么选
- 西安 GEO 服务商推荐
- GEO 优化公司哪家可靠
六句问法、226 个样本,提及数为 0。这不是某一句问得不好,是整条链路还没打通。
还有一条边界要说清:提及口径不区分正负。这 249 次里既有正常描述,也有 AI 基于过期信息给出的错误陈述(例如称查不到工商登记)。被提到不等于被认可,更不等于被推荐。
结论三(TBL):跨平台交叉引用非常稀缺
| 口径 | 数值 | 说明 |
|---|---|---|
| URL 级(同一条链接被 ≥2 个 AI 引) | 2 个 | 最严口径 |
| 域名级(同一域名被 ≥2 个 AI 引) | 13 个 | 较宽口径 |
两个口径差了好几倍,引用时必须写明用的是哪一个。被多个 AI 同时引到,说明这个来源不依赖某一家的偏好——这个数量级的稀缺,才是「被记住」的真实门槛。
换个维度看:同一批 554 条引用,按平台拆开,各自引到的网站几乎不重叠。
| AI 平台 | 引用样本 | 不同网站数 |
|---|---|---|
| 知乎直答 | 176 | 20 |
| DeepSeek | 131 | 45 |
| 元宝 | 113 | 46 |
| 智谱清言 | 104 | 17 |
其余 5 个平台本期样本都不到 20 条,按纪律只登记、不比较:样本 5 条的时候,多一条少一条,占比就翻倍。
一家平台高度自引,另一家散在四十多个站上——拿一家平台的集中度去推断另一家,结论会反。
QA:直问直答
Q1:被引到底怎么算? 一条记录 = 一次提问 + 一条回答;回答里没给链接也照样记,但不计入「带被引链接」。只有回答文本里出现以 http 开头的地址,才归进被引。带链接的算「被引」,只写名字的算「提及」,两套账分开记,不换算、不相加。
Q2:你们自己发的内容,被 AI 引用了吗? 没有。同一查询日按自有域名过滤,带链接的引用里出现我方域名的记录是 0 条;同期已发布内容 19 条、覆盖 5 个平台。这里要把话说白:发布不等于被引用,收录与抓取周期都还在走。
Q3:一个网站被几个 AI 引用,为什么比被引几次更重要? 因为被多家同时引到,说明这个来源不依赖某一家的偏好。全库 258 个被引网页里,只有 2 个被两个及以上平台引到,放宽到域名级是 13 个。交叉印证看的是来源数量,不是出现次数——同一个说法出现在五个地方,在 AI 眼里仍然是一个来源。
Q4:被引最多的通常是哪一类网站? 内容社区、门户、行业站与视频站。品牌自己的官网很少出现在这些位置上:AI 偏好的是能解答问题的第三方内容,而官网通常只讲自己。这是观察到的一类结构,我们不对任何一家网站的经营状况或可用性作评价。
Q5:这组比例能套到我的行业吗? 不能。这是单一行业、单一项目的一次快照,换行业、换问法类型,信源结构会差很远。它只说明这类问题该怎么测,不构成任何效果承诺。
你可以自己验一遍(HOW)
- 写 6–10 句客户真会说的整句话,不要写关键词。
- 在你常用的 AI 平台各问一遍,把整段回答原样存下来,记下提问日期。
- 数其中给了链接的有几条;没给链接的追不到信源,只能算「提到」。
- 把链接剥到主域名去重,看前几名占了多少。
- 再筛一遍:这些位置里,哪些是你自己能发进去的。
- 隔 7 天、30 天用同一批问法重跑,看数字有没有真的动。
做到第 5 步你会得到一个很朴素的结论:能发的地方很多,值得发的地方很少。判断依据不是感觉,是那几张链接统计表。
口径与局限(PROV)
- 数据源:我们自建的 AI 可见度监测系统,生产库
citations表,项目「知寻 GEO」自监测。 - 查询日:2026-09-24。
- 样本量:抓取记录 3,525 条;其中带被引链接 554 条;去重网页 258 个、去重网站 131 个;问法口径 A 850 条 / B 2,675 条 / C 226 条。
- 口径:被引只算给出 URL 的引用;去重分「链接级」与「域名级」两套;三个问法口径分母不同,不合并、不相加。
- 局限:① 单一项目、单行业的观测,不可外推到其它行业;② 信源库每天都在增长,本页数字是 2026-09-24 的时点快照——同一天更早一次重跑是 3,471 条,本页是同日更晚的 3,525 条,两个数不矛盾,只是两个时点;③ 提及口径不区分正负;④ 11 个平台里有 5 个样本不到 20 条,只登记、不比较;⑤ 域名级的数字讲的是平台自身的信源地位,不能读成「我方内容被引用」。
本页结构:DEF 定义块 · TBL 数据表 · QA 直问直答 · HOW 可复现步骤 · PROV 口径块(数据源 / 查询日 / 样本量 / 口径 / 局限 五字段齐全)。
本文数据来自知寻智能的 AI 可见度监测系统。项目实测:抓取记录 3,525 条 / 带被引链接 554 条 / 查询日 2026-09-24 / 本期实抓 11 个中文 AI 平台(已接入 12 个)。实际效果因行业、内容基础与问题类型而异,本文不承诺任何效果。
本文含 AI 辅助生成内容,经人工核实。
想了解更多?
获取品牌在主要国内 AI 平台的提及与引用状态简版报告(一期人工交付,1 个工作日内出具)。
本文由 知寻智能编辑部 撰写,数据来源已在文中标注;提升品牌被 AI 引用与推荐的概率与频次,不构成效果承诺。
