引用信号
本页面是 GEO 的写作部分。开启 GEO 会为您的页面添加 TL;DR 区块、日期和作者;切换开关不会决定某个句子是否可被提取。这取决于其所在部分的写法,而下面的规则正是有机制依据的规则。
每条规则都以相同的方式阐述:规则本身、检索与生成堆栈为何会以这种方式运行,以及一个可以打开的来源。如果证据不足,规则中会明确说明。
规则一览#
| 规则 | 该规则对堆栈行为的解释 | 来源 |
|---|---|---|
| 让每个部分都能独立存在 | 检索针对单个段落评分,而不是整页评分 | Google 排名系统 |
| 在每个部分中完整写出主题名称 | 文本块在没有相邻内容的情况下进行嵌入;补回缺失的上下文能够显著提升检索效果 | Anthropic,上下文检索 |
| 在标题后的第一句话中回答问题 | Docsbook 自带的 TL;DR 提取器和 speakable 标记会提升开头内容的权重;没有公开基准单独验证这一点 |
机制,见下文 |
| 添加直接引语 | 引语添加是该基准测试中效果最佳的方法:在超过 1 万次查询中,按位置调整的词数指标显示,“最佳方法比基线提升了 41%” | GEO,KDD 2024 |
| 添加统计数据 | 统计数据添加是三种方法之一,在同一指标上实现了“30-40% 的相对提升” | GEO,KDD 2024 |
| 引用自己的来源 | 引用来源属于同一个 30-40% 的组别 | GEO,KDD 2024 |
| 使用清晰直白的语言 | 流畅度优化和易于理解这两种方法合计实现了“15-30% 的显著可见度提升” | GEO,KDD 2024 |
| 在页面上标注作者和日期 | Google 的自我评估问题会询问页面是否“包含作者署名(在通常应有署名的情况下)” | 创建有帮助的内容 |
| 不要堆砌关键词 | 关键词堆砌被归入“无效”方法,其得分低于未经处理的基线;在实际运行的搜索引擎上,它“比基线差 10%” | GEO,KDD 2024 |
| 不要为了让页面“便于引用”而删减正文 | 在 171,003 份文档中,仅优化正文使前 20 名检索出现率下降了约 9%,最终引用率下降了约 6%(Kim 等,2026,调查中进行了总结) | 调查,arXiv 2607.14035 |
| 不要屏蔽会进行引用的代理 | 选择退出的网站“不会出现在 ChatGPT 搜索答案中,但仍可能作为导航链接出现” | OpenAI 代理 |
为什么是段落,而不是页面#
Google 将其段落排名系统描述为:该系统会识别网页中的“各个部分或‘段落’,以更好地理解页面与搜索内容的相关性”(排名系统指南)。检索增强型助手做的事情更加激进:文档会被拆分成多个块,每个块单独生成嵌入并进行评分,只有胜出的块才能送达模型。
Anthropic 明确说明了这种失败模式。一个写着“该公司的收入比上一季度增长了 3%”的块“没有说明它指的是哪家公司,也没有说明相关的时间段”,因此对于提及该公司的问题,它无法被检索出来。在生成嵌入之前重新附加上下文后,“前 20 个块的检索失败率降低了 35%”,与上下文 BM25 结合后,“降低了 49%”(Anthropic:上下文检索)。
这就是供应商在设法弥补那些没有点明自身主题的文字。明确点明主题的文字则不需要这种修复。这也就引出了两个比其他所有规则都更重要的原则:
- 在每个部分中完整写出主题。“要轮换它,请调用该端点”是无法检索的——其中没有任何内容说明指的是哪个产品,也没有说明被轮换的对象是 API 密钥。
- 在标题后的第一句话中给出答案,然后再展开说明。“在开始介绍轮换之前,了解……是值得的”来得太晚,无法成为被选中的段落。
引用测试。将一个部分粘贴到空文件中。如果它不再说明自己的主题,就重写它。这正是检索器在你的页面上执行的操作。
Docsbook 如何机械地处理这些规则#
Docsbook 的三个部分会直接读取上述形式,因此遵循这些规则会改变实际输出,而不仅仅是影响你的成功几率:
- 你的第一段会成为机器摘要。 如果页面的 frontmatter 中没有
tldr:,GEO TL;DR 块会根据文档的第一段实际段落生成——标题、引用块、列表、代码围栏和仅包含图片的行都会被跳过——上限为 280 个字符。少于 40 个字符的导语不会生成任何块。 - 疑问式标题会成为结构化数据。 启用 AEO 后,任何以问号结尾的
###标题都会作为Question输出到FAQPageJSON-LD 中,其下方的段落会作为答案;每页最多处理 20 个问题,每个答案最多 1,000 个字符。因此,将标题表述为读者的问题并非风格偏好——它是检测器的输入。 audit_geo会检查机械前提条件,包括原始 HTML 中是否至少包含 200 个正文单词且未执行 JavaScript,以及页面是否声明了任何日期。
具有实测效果规模的规则#
GEO 论文(KDD 2024)构建了 GEO-bench,其中“包含 1 万条查询”,并针对生成式引擎设置测试了九种内容转换方式,每次查询“仅使用从 Google 搜索引擎获取的排名前 5 个来源”。其可见性指标“位置调整词数”(Position-Adjusted Word Count)会根据引用出现的位置,对生成答案中归因于你的来源的内容量进行加权。
以下是论文原文列出的数据。论文报告的是区间和总体结论,而不是逐方法的百分比表,因此我们也不提供后者:
| 论文报告的内容 | 论文原文 |
|---|---|
| 在位置调整词数方面表现最佳的方法 | “最佳方法在位置调整词数和主观印象方面分别比基线提升 41% 和 28%”(最佳方法是引文添加) |
| 来源引用、引文添加、统计数据添加 | “在位置调整词数指标上实现了 30-40% 的相对提升,在主观印象指标上实现了 15-30% 的相对提升” |
| 流畅度优化和易于理解 | “诸如提升来源文本流畅度和可读性等风格变化……也带来了 15-30% 的显著可见性提升” |
| 关键词堆砌和独特词汇 | 在结果表中归入“未发挥作用的生成式引擎优化方法”。关键词堆砌的得分低于未经修改的基线 |
| 同样的九种方法在真实引擎(Perplexity.ai)上的表现 | “引文添加在位置调整词数方面表现最佳,比基线提升 22%”,而关键词堆砌“比基线差 10%” |
| 总体而言 | “GEO 可以使生成式引擎响应中的可见性最高提升 40%” |
应将这些区间理解为“当你的页面已经呈现在模型面前时,模型会复用其中哪些句子”,而不是流量预测——请参阅下方的限制。论文还报告称,效果因领域而异:统计数据添加表现最佳的标签是法律 & 政府、辩论与观点;引文添加表现最佳的标签是人物 & 社会、解释和历史。
实际操作中:让每个页面都包含可提取的内容——限制、超时、版本、单句定义,或注明来源的数字。具体事实才是模型会逐字提取的内容。而且绝不要凭空捏造:助手重复错误数字的危害大于没有答案,而且错误内容存在的时间可能比你的更正更久。
关于不要做什么的规则#
不要堆砌关键词。 在基准测试中,这是唯一一种得分低于完全不修改页面的做法。
不要为了让文字“便于引用”而删减正文。 2026 年对 45 项 GEO 研究进行的批判性调查报告了一项受控结果(Kim 等,2026 年;171,003 份文档,2,700 个查询):仅优化页面正文会“使平均前 20 名出现率降低约 9%,重新排序后的前 10 名出现率降低 16%,最终引用率降低 6%”(arXiv 2607.14035)。调查中最值得记住的解释是:改写可以提高在已被检索到的情况下被引用的概率,却会降低页面被检索到的概率,而总体效果最终变为负面。正文承载着能够匹配不同问题的同义词多样性。将定义和数字添加在它的旁边,绝不要用它们替代正文。
不要阻止负责进行引用的代理。 不同供应商会出于不同目的运行不同的爬虫,阻止其中一个并不会阻止其他爬虫:
| 代理 | 供应商自身的描述 | 用途 |
|---|---|---|
OAI-SearchBot |
“用于在 ChatGPT 的搜索功能中将网站展示在搜索结果里”——选择退出的网站“不会显示在 ChatGPT 搜索答案中” | 搜索 |
GPTBot |
“抓取可能用于训练我们的生成式 AI 基础模型的内容” | 训练 |
Claude-SearchBot |
“浏览网页以提升用户的搜索结果质量” | 搜索 |
ClaudeBot |
“收集可能对其训练有所贡献的网页内容” | 训练 |
PerplexityBot |
“在 Perplexity 的搜索结果中展示并链接网站。它不会用于抓取 AI 基础模型的内容” | 搜索 |
来源:OpenAI、Anthropic、Perplexity。在允许搜索的同时阻止训练,是一种合理的商业决策。在期待获得引用的同时阻止搜索代理,则是不合理的做法,而且几乎总是意外造成的——audit_geo 将其报告为严重问题。
不要指望某个特殊文件或架构能够替代写作。 Google 表示,“要出现在 AI 概览或 AI 模式中,不存在额外要求,也不需要其他特殊优化”,并且“你不需要创建新的机器可读文件、AI 文本文件或标记”(Google AI 功能)。关于专门针对该文件提出的同一问题,请参阅 llms.txt。
限制与未决问题#
- 已测得的收益取决于内容是否已经被检索到。2026 年的调查得出结论:基础结果“在其所设定的实验环境中有效,但前提是来源已经存在于固定上下文中”,并且“所审查的技术中,没有任何一种显示出对自然发现性或后续行为具有稳定、长期、跨平台的因果影响”。上述所有措施,都是在你进入上下文窗口后提高成功概率。进入上下文窗口则属于 SEO 工作。
- 尚待回答的问题:新鲜度是否会提高引用率?Google 针对搜索排名记录了“查询值得新鲜度”系统,而没有日期的页面无法为模型提供任何可归因于时效性的依据。没有任何一手来源衡量可见日期带来的引用率提升。在有人发布测量结果之前,应将新鲜度视为维护规范。
- 一次运行不能证明任何问题。调查中总结的审计显示:Schulte 等人(2026 年)在四个引擎、45 天的数据中“观察到来源级 Jaccard 分数约为 0.34–0.42”,并提出“每个提示词重复七到八次可作为起点”;Kirsten 等人(2026 年)报告称,“两个月内的页面重叠率,AI Overviews 为 18%,而 Google 自然搜索为 45%”。在相信任何前后对比检查结果之前,都应重复进行多次。
- 上述数字来自一个基准和一个时代。GEO-bench 于 2024 年在固定的引擎配置下进行评估。研究结果的方向经审查后仍然成立;但不应将其幅度作为你的预期结果引用。
- Docsbook 不会为你测量这些内容。你的分析工具能够显示的是痕迹:来自助手用户代理的爬虫访问,以及来自助手域名的引荐流量。未被你观察到的引用不是一种指标。