Docsbook
概览

分析概览

文档仪表板很容易做得令人印象深刻,却很难做到易于使用。 区别在于每个数字是否说明了它看不到的内容。本页将逐个介绍面板中的磁贴和选项卡,并针对每一项说明它统计的内容、数据来源,以及它不支持的解读。所有这些内容下方的定义——谁算作访客、如何排除机器人和您自己的团队、数据保留多长时间——都在 测量工作原理中,本文不再重复。

你将获得什么#

一个页面,从一个来源回答所有者实际提出的问题。 七个主要指标卡片中的六个都是访问的属性,而且这六个指标都 来自同一条重建的事件流,而不是来自六个独立的计数器——因此,这里的跳出率与结果拆分 中的跳出率采用的是同一种计算方式,并不是两个使用同一名称的数字。读取其中任何内容 都不会消耗项目余额,而且所有内容均不受套餐限制。

它是如何构建的#

七个指标#

指标 定义 可制图
访客 时间窗口内至少有一次人工访问的独立访客,分为新访客/回访访客
收入 转化次数 × 您的平均产品价格
支出 从此项目余额中扣除的金额——AI 调用加上 MCP 调用
转化率 转化次数 ÷ 访客数
每位访客收入 收入 ÷ 访客数
跳出率 被归类为跳出的访问次数 ÷ 访问次数
会话时长 平均访问时长

收入是一个指标,但从不制成图表。 它等于转化次数乘以一个 常数,因此其折线只会是带有不同坐标轴标签的转化折线: 同一个事实被绘制了两次。其随时间的变化形状可从转化率中读取。

转化是指从您的文档点击到行动号召 URL 所指向的主机。 按主机匹配,其中 www. 会被 合并,而其他子域名则刻意合并——您的文档通常位于子域名上,合并后会把“返回文档” 计为一次销售。访客点击五次也只算一次转化。

两个金额指标在两个设置存在之前都会保持停用状态:行动号召 URL 决定哪一次点击属于转化,平均产品价格决定它的价值。在两者都设置之前,它们会显示短横线并注明缺少哪一项—— 绝不会显示 $0。缺少价格不等于价格为零,而收入是所有者无需检查其计算方式 就会据此采取行动的数字。两者都位于 品牌中。验证器出于同样的原因会拒绝 0 的存储价格。

支出在每个方面都是例外。 它表示资金流出,而不是访问的 属性;它来自计费账本,而不是事件流;并且它是此处唯一一个其 0 是实际读数的数字。以下 后果值得了解:

  • 它不会抵扣。 充值不会使其下降;支出回答的是“这个项目让我花了多少钱”, 而这个问题只有一个方向。
  • 它会忽略您的筛选条件。 筛选条件会缩小访问范围,而翻译运行 不是一次访问——“美国”与嵌入任务毫无关系。
  • 即使时间窗口为空,它也会保留。 凌晨 3 点运行的翻译是真实账单, 即使其背后没有读者,而这往往正是此指标最有用的展示内容。其他所有指标在这样的时间窗口上都会显示“没有可测量的访问”。
  • 它的箭头没有颜色。 支出因读者请求增加而上升,说明产品正在运作;支出因任务卡住而上升,则意味着出现故障。其他所有变化都会以绿色表示好消息——跳出率下降也是绿色—— 而这一项保持灰色,因为面板没有证据判断属于哪种情况。
  • 无法读取账本时,该指标会被停用并明确说明,而不是显示 $0。它统计的内容位于AI 使用量和成本中。

每个指标还会显示与紧接其前、长度相同的时间窗口相比的变化。从前一个值为零开始的增长 完全不会绘制箭头:它是未定义的,而不是 +100%

四个细分卡片#

每个卡片都是一个可滚动的标签栏;其中十个标签是从与磁贴相同的访问流中提取的排名维度, 另外四个来自其他位置。

卡片 标签 每次访问一个值?
页面 页面、标题、入口、出口 入口和出口是;页面和标题否
来源 引荐来源、渠道、UTM、关键词 引荐来源和渠道是
受众 设备、浏览器、国家/地区、语言
转化 CTA 点击、反馈、搜索 按事件计数

单值维度会对时间窗口进行划分——它们的访客数总和等于总数。页面和标题则不会:一次访问的转化会归因于它访问过的每个页面,因此这些行属于辅助归因,且有意相加后超过标题中的总数。卡片会在屏幕上对此进行说明。

排名标签中的每一行都包含两个数值——它带来了多少访客,以及这些访客的价值——其后还有两条柱状图:一条表示列表的排名依据,另一条始终表示收入。行由服务器按访客数排序,并在浏览器中重新排序,因为如果服务器返回“按收入排名靠前的行”,那么切换开关时返回的就会是一个不同的集合,行也会随着切换而出现和消失。

页面和标题还提供两个额外的排名ViewsReading time。 对于指向文档中某个位置的行,它们有实际意义;而对于指向某个国家/地区的行则没有意义,因此它们只在这两个标签中提供。没有阅读时间测量值的页面会显示短横线,而绝不会显示 0

筛选#

按行筛选会缩小所有内容的范围——其他卡片和图表上方的磁贴——因此可以端到端地查看某个国家、设备或引荐来源。筛选条件会叠加,点击其标签即可移除。卡片和磁贴会将相同谓词应用于相同的重构访问,这正是为了避免“美国”在卡片中表示一种含义,而在其上方的图表中表示另一种含义。

事件而非访问次数统计的标签页——标题、UTM、AI 视图、CTA 点击、反馈和搜索——无法通过这种方式进行筛选。筛选启用时,它们会在各自行上方说明这一点,而不是在已筛选的标题下显示未筛选的数字。

并非来自访客的四个选项卡#

  • 关键词 来自 Google Search Console。一次从未转化为点击的展示,在您网站上运行的任何工具中都是不可见的,因此这是 Google 的数据:查询、排名、展示次数、点击次数和点击率。请先连接 Search Console。其收入列明确是一个估算值——点击次数 × 您网站整体的每位访客收入——并加以标注且以单独的一列呈现,因为一个建模得出的数字放在实测数据旁边时,不能让人误以为它们属于同一性质。
  • CTA 点击 按读者离开您的文档后前往的每个目的地,以及他们从哪个页面前往该目的地进行排名。
  • 反馈 根据页面获得的拇指评价为页面排名,首先显示不喜欢:人们投了反对票的页面,就是需要重写的页面。两个投票组件会合并统计——页面底部的评分和在那里给出的 AI 答案上的拇指评价——因为问题在于读者认可哪个页面,而不是他们按下了哪个按钮。零值始终会显示。
  • 搜索 按读者在页面搜索框中输入的内容进行排名,并显示搜索找到结果的次数以及返回空结果的次数——同样的词语可能同时计入这两项。没有结果的查询,是读者用自己的话告诉您文档应该涵盖什么。它没有指标菜单:这些行是按搜索而非按访问统计的,因此没有可供排序的收入。

渠道,以及为什么一行渠道信息还不够#

“渠道”选项卡会按来源的类型对访问进行分组——自然搜索、付费搜索、社交媒体、AI 助手、引荐、直接访问、内部访问——分类依据是事件写入时的情况,而不是读取时的情况。这一点有两方面的重要性:AI 引荐带有空的引荐来源,因此仅按引荐来源分组会将它们埋没在“直接访问”中;而付费的 Google 点击和自然搜索的 Google 结果具有相同的引荐来源,因此付费 utm_medium 必须优先于它。将鼠标悬停在某个渠道上时,会显示它实际包含的三个网站及其占比——一个几乎完全来自 Google 的自然搜索行,与一个分布在五个搜索引擎之间的自然搜索行,代表的是不同的情况。

AI 视图#

三个标签页,分别对应爬虫到访的三种原因,因为这三种原因支持的决策完全不同:

标签页 含义 支持的决策
回答 有人获得回答时进行的实时抓取 你的页面被引用给了某个人。值得在其中添加链接和当前价格
索引 构建助手日后从中检索的语料库 未来能够被引用的前提
训练 用于模型训练的批量采集 只有一个:是否允许

在每个标签页中,你可以按页面(助手读取的页面)或爬虫(每个机器人一行,并标注其提供商)进行分组。分类依据是 User-Agent 与一个包含 23 个已命名机器人的表格进行匹配,首个匹配项优先——因此 Applebot-Extended 永远不会被 Applebot 吞掉——而无法识别的 AI 机器人则会被视为训练机器人,这是对你承诺最少的归类。

时间范围#

范围 涵盖内容
现在 按分钟分桶、实时刷新的滚动小时
今天 截至目前的UTC日历日
昨天 完整的前一个 UTC 日历日
过去 24 小时 从现在向前滚动的一天
过去 7 天 滚动的一周
过去 30 天 滚动的一个月——最长的时间窗口

今天和昨天是UTC中的日历日,而不是您本地时区中的日历日, 也不是滚动的 24 小时:在 UTC 日刚开始时,今天涵盖的时间少于过去 24 小时。数据截止于三十天。

现在是独立的时间窗口,而不是重新标记的某一天——实时视图只能以分钟为分辨率读取, 而按分钟分桶的完整一天会产生 1,440 个数据点。在“现在”范围内,磁贴和图表每 5 秒刷新一次,卡片每 30 秒刷新一次;切换到其他任何范围后,刷新就会停止,因此您未在查看的历史范围绝不会在您不知情的情况下重新获取。

当前在线——过去 5 分钟内活跃的读者——不属于七个磁贴之一。它是当前时刻的指标,而不是您所选时间窗口内的总数, 因此它作为独立的标签显示在面板标题旁边;将其放入条带中,会让人误以为可以将它与一个并不属于它的时间段进行比较。

暂时没有数据可供报告#

一个没有任何自有行的标签页会在淡化的示例数据上显示 “启用 标签页”,按下该按钮后,会在这些相同的数据上运行一个简短的指南。它是按标签页计算的,而不是按卡片计算的——Entry 在每次访问时记录一个页面,而 Pages 会统计每次访问所触及的每个页面,每条说明都归属于与其相关的标签页。该开关不会控制任何内容:所有数据始终都在收集, 选择结果会按工作区记忆在浏览器中。

为什么这是正确的做法#

规则 有效原因 来源
衡量访问是否成功,而不是访问涉及多少页面 “如果用户无法完成其目标任务,其他一切都无关紧要。用户成功是可用性的底线”——Nielsen & Budiu,2001 年,2021 年审阅 NN/g:成功率
按用途对爬虫进行分类,而不是将其归入一个“机器人”类别 供应商本身划分了界限:GPTBot 可能会“抓取可能用于训练的内容”,OAI-SearchBot 的存在是“为了在搜索结果中展示网站”,而“ChatGPT-User 不会以自动方式用于抓取 Web” OpenAI 机器人
User-Agent 是一种声明,而不是身份 Google 发布了爬虫验证指南,因为网站所有者“担心垃圾邮件发送者或其他捣乱者在声称来自 Google 的同时访问您的网站” Google Search Central:验证 Googlebot
Search Console 数据是 Google 的数据,并且是临时的 Google 表示“最新数据可能是初步数据,这意味着数据仍在收集,接下来几小时内可能会发生变化”,并将展示次数定义为“您的网站在搜索结果中出现的次数”——这是任何站内跟踪器都无法看到的数字 Google:效果报告
建模得出的数据不应看起来像测量得出的数据 Keyword 选项卡中的收入等于点击次数 × 全站每位访客收入;正因如此,它被标记为 (est.),并使用虚线条显示 机制,本页面

限制与未解问题#

  • 每个访客数据都是估算值,产品对此有明确说明。 访客是经过哈希处理的 IP:一个公司网络会合并为一个读者,而同一位通勤者可能被拆分为多个读者。请将其视为趋势,而不是人数统计。
  • 基于少量访问得出的百分比只能表示方向,而不是测量结果。 访问次数少于 30 次时,面板会在数据下方明确说明,而不是给出看似确切的比例。
  • 超大时间窗口是基于样本读取的,产品也会明确说明这一点。 会话重建最多读取 50,000 个事件;达到此上限后会设置 truncated 标志,卡片会用文字说明这一情况,因为基于截断窗口计算出的比例是不准确的。
  • 差值会消失,而不是提供误导信息。 如果上一个时间窗口读取失败,则完全不显示差值。页面和标题行会有意进行过度归因——它们属于辅助归因;请不要将它们相加。
  • 跳出是一种描述,而不是评判。 只浏览一个页面、停留少于三秒、没有其他操作——而一个一眼就找到答案的读者也可能呈现出同样的情况。
  • 需要注意:“会话时长”并不等于注意力。 可以验证的是其计算机制——按访问次数对分段进行统计,设置三秒下限,并对每个分段设置 300 秒的上限。无法从任何网站分析数据中验证的是某个人是否正在看屏幕,而此面板并未暗示这一点。请参阅阅读时长
  • 三十天就是全部历史记录。 没有同比数据,没有季节性分析,也没有超过四周的群组分析。

如何打开#

打开文档网站的任意页面,然后点击底部浮动工具栏中的分析选项卡。 概览会加载你上次选择的时间范围,并且会在多次访问之间记住该选择。

Updated

此页面对您有帮助吗?