放大镜放在分析数据上,代表数据准确性验证

如何确保您的网站分析数据准确无误

错误的分析数据比没有分析数据更糟糕。准确的数据告诉您需要改进什么;不准确的数据则会引导您改进错误的东西。大多数网站所有者认为他们的分析工具默认情况下会提供良好的数据。实际上,每个分析实现都存在多个未被解决的失真源——有些数字被夸大,有些被缩小,趋势看起来比实际情况更好或更差。

最常见的分析数据不准确来源

机器人和爬虫流量

搜索引擎爬虫、正常运行时间监视器、安全扫描器和自动化工具定期访问您的网站并生成非人类的页面浏览量。在较小的网站上,机器人可能占总流量的 20-40%。如果您的分析工具不能自动过滤这些机器人,您的访客计数会明显夸大,您的参与度指标(跳出率、会话时长)也会失真——机器人通常会显示为即时跳出。

好的分析工具会自动通过用户代理、请求模式和已知爬虫 IP 范围过滤机器人。检查您的机器人流量报告,了解原始点击中有多少百分比是非人类流量,并确认机器人已从您的主要指标中排除。

来自您自己团队的内部流量

每当开发人员测试页面、内容编辑器审查草稿或支持团队成员查找文档时,他们都会生成污染您数据的页面浏览量。对于小型网站,内部流量可能代表总会话中不成比例的份额——特别是在开发或内容发布期间,当您的团队积极在网站上工作时。

解决方案是通过 IP 地址过滤内部流量。将您的办公室 IP 范围和任何已知的团队成员家庭 IP 添加到您的分析排除列表中。在 statpx 上,这在站点设置中处理。随着团队成员的变化和办公室网络的更新,每季度审查一次您的 IP 排除列表。

重复追踪标签

在同一页面上加载两次追踪代码片段会将每个页面浏览量计数加倍。这比您想象的要频繁得多——当新分析工具被添加而旧工具仍在运行时、代码片段被硬编码到模板中并且也通过标签管理器注入时,或者当 CMS 插件在手动放置的脚本旁边添加第二个实例时。症状是页面浏览量计数神秘地接近您从流量来源期望的恰好 2 倍。

通过在代表性页面上打开浏览器的网络检查器来验证,检查每次页面加载时追踪端点被调用多少次。应该恰好一次。

缺失页面

相反的问题:您的追踪代码片段缺失或损坏的页面。即使这些页面收到大量流量,这些页面也会生成零数据。常见原因是在您的常规 CMS 工作流之外构建的页面(登陆页面、结账流程、特定于活动的微网站)、由于脚本链早期错误导致 JavaScript 加载失败的页面,或未触发虚拟页面浏览量事件的单页应用程序路由。

定期交叉参考您跟踪的页面与您的网站地图,以识别缺口。如果您的网站地图中的 URL 从未出现在您的分析中,则它要么没有获得流量,要么没有被追踪。

如何验证您的分析设置

每月快速验证可以在漂移复合成数月的错误数据之前抓住它。该过程大约需要 15 分钟:

  1. 打开隐私浏览窗口,访问您网站上的五个代表性页面。检查每个页面在 30 秒内在您的实时报告中注册页面浏览量。
  2. 将您的每月总会话数与同一时期的服务器访问日志行计数进行比较。分析将始终更低(排除机器人、阻止的脚本等),但如果对于内容网站来说少于您的服务器日志流量的 50%,请调查缺失的追踪。
  3. 过滤您的访客列表以获取您自己的 IP 地址,以确认内部流量排除正常工作。您应该看到零或接近零的结果。
  4. 检查您的热门页面报告是否存在任何可疑条目——暂存 URL、管理路径或内部工具页面,这些表示跨环境污染。

使用 statpx 从一开始就获得干净的分析数据

statpx 通过用户代理和 IP 范围自动过滤机器人,让您在站点设置中排除内部 IP,并向您展示专门的机器人流量报告,因此您始终知道正在过滤什么。

免费开始 →

总结

准确的分析数据需要主动维护,而不仅仅是安装。四个最常见的准确性问题——未过滤的机器人、未排除的内部流量、重复的追踪标签和缺失的页面——都是可修复的,一旦您知道寻找什么,都相对容易检测。将季度数据质量审查纳入您的分析常规,并将您的数字中任何可疑的峰值或下降视为检查实现的提示,而不是立即跳出关于您的营销或内容中发生了什么变化的结论。

Continue reading

Technical
How to Identify and Block Referrer Spam in Website Analytics
Technical
How to Filter Your Own Visits Out of Website Analytics
Technical
Custom Dimensions in Analytics: Track Extra Context Beyond Pageviews
Analytics by statpx