文献归档与本地全量阅读•已完成本地化拉回
geo-citation-lab 引用特征开源实验室:基于上万条引用记录的 AI 搜索特征深度审计
随着生成式 AI 搜索平台(ChatGPT Search, Google AI Overviews, Perplexity)深度重塑互联网入口,如何让内容不仅能够被 AI “搜索到”,更能够被模型“深度吸收与引用归因”,已成为 GEO 内容工程的核心诉求。
geo-citation-lab 是一个专注于大模型检索和引用特征研究的开源资料库。它提供了基于真实脚本运行的可复查数据,详细解答了 AI 搜索在 “触发联网 → 筛选信源 → 吸收内容” 闭环中的物理及语义倾向。
一、 实验设计与 Snapshot 数据快照
本研究基于 602 条测试 Prompt 进行控制变量刺激测试,累计采集三大平台(ChatGPT, Gemini, Perplexity)生成式回答,提取了 21,143 条搜索层引用与 23,745 条 citation-level 特征记录,并抓取了 18,151 个成功访问的源页面进行 72 维语义特征比对:
| 实验统计指标 | 数值 |
|---|
| 设计 Prompt 总数 | 602 |
| A/B/C/D 四层控制组 | 432 / 60 / 60 / 50 |
| 生成式回答搜索触发率 | 98.64% - 100% |
| 引用关联特征总行数 | 23,745 |
| 引用抓取成功样本数 | 18,151 (76.44%) |
二、 16 条带数字的核心科学洞察
- 高度联网触发: 三大平台联网搜索概率极高:ChatGPT 为 98.64%,Google 为 99.67%,Perplexity 为 100%。
- 引用宽度悬殊: 触发搜索后,平均单条回答引用源文件数:ChatGPT 为 6.88 个,Google 为 12.06 个,Perplexity 为 16.35 个。
- 用得深不等于搜得多: ChatGPT 引用数量最少,但其单条引用的平均吸收影响力得分高达 0.2567,是 Google (0.0455) 的 5.64 倍,是 Perplexity (0.0548) 的 4.68 倍。
- 引导语效应: 强制加入“请携带可靠引用”等约束的 A/B 实验组,平均引用源数由 12.35 提升至 13.07,Google 提升幅度最大(达 15.90)。
- 语言隔离墙: 英文 Prompt 平均引用源数量为 11.68 个,中文 Prompt 为 10.41 个,其中 Google 的双语差距最大 (11.57 vs 7.53)。
- 模糊提问倾向: 宽泛模糊的问题触发的搜索源较少 (平均 9.97 个),而长决策型问题能够触发多达 13.70 个引用源。
- 源头集中度: 三大平台高度青睐
官网 + 新闻 + 垂类行业站。这三类来源在 ChatGPT 占 87.52%,Google 占 87.34%,Perplexity 占 79.12%。 - 美国地区垄断: 在可识别地理位置的引用链接中,US 域名具有压倒性份额:ChatGPT (85.89%)、Google (86.76%)、Perplexity (82.70%)。
- 英文霸权: 可识别语言样本中,英文占比高达 82.90% - 95.07%,面向海外推广的项目必须准备英文版 Markdown 路由。
- 高权重门槛: 最终被引用的页面 Domain Rating (DR) 中位数依然较高,三平台均在 520 - 600 区间,DR >= 500 的占比过半。
- 网页长度是硬门槛: 被高频深度引用的 Top 四分位页面平均长达 1,943 词,而 Bottom 四分位垫底页仅为 170 词,相差达 11.4 倍。
- 列表与段落结构化: 高吸收率页面平均包含 10.59 个 H2/H3 标题、47.49 个段落、列表元素密度达 0.428,低吸收率页面的相应指标几乎为零。
- 语义对题最关键: 预测 AI 是否吸收的最高相关因子是
llm_relevance_score (语义相关度相关系数 r = 0.432),显著高于域名的传统权重评分。 - AI 喜爱“块状证据”: 含有具体定义的可引用页面吸收度提升 57.3%,含对比表格提升 55.3%,包含 Step-by-Step 实操指南提升 41.2%。
- FAQ 格式反效果: 传统 SEO 倡导的 Question & Answer 列表,在 AI 检索端反而录得 -5.7% 的负相关影响力。
- 引用流向偏差: LLM 在多处回答中引用同一链接的吸收率高达 76.44%,长内容切分块在 RAG 管道中往往会被多次调用。
三、 反常识实验结论
- 观点无用,证据至上: AI 极度偏爱具体数据和清晰定义,对泛泛的抒情和纯文字观点描述缺乏提取意愿。
- 字数并非累赘: 传统的“网页字数越短越有利于快读”在 AI 搜索端失效。太短的页面因无法切出高语义密度 Chunks 而被检索池直接丢弃。
- FAQ 刷分是注水: 各种 GEO 审计评分工具要求加入 FAQ Section。实验表明 FAQ 对提升引用无正面关联。
四、 科学 GEO 内容写作框架 (证据页骨架)
为了让文章被 AI 深度引用,请在页面结构中严格落实以下“块状内容”:
# 标题:[描述性自然语言,直接对齐潜在用户的 Search Query]
## 1. [核心概念定义]
包含一句明确的“什么是...”陈述(定义类型页面平均影响力 +57.3%)。
## 2. [关键事实数据]
至少包含 3 个带明确单位的统计指标或测试参数(事实类型页面平均影响力 +61.6%)。
## 3. [主流方案对比]
利用 H3 标题或 Table 表格将 A 与 B 进行多维度对比(对比类型页面平均影响力 +55.3%)。
## 4. [实操步骤与建议]
Step-by-Step 列出具体的操作命令、安装脚本或配置清单。