如何从网站分析中过滤自己的访问
每当您打开自己的网站检查布局、测试按钮或审查新文章时,您的分析工具都会记录一个页面浏览。如果您正在积极开发或维护一个网站,您可能每天访问它几十次——每次访问都为您的数据增加噪声。开发人员、内容编辑和在客户网站上工作的机构员工可能占记录流量的相当大比例,特别是在较低流量网站上,几百次内部访问代表总流量的显著百分比。
过滤自己的流量不是小型网站的可选操作——这是测量受众和测量自己之间的区别。以下是主要方法的工作原理、其权衡,以及如何检查内部流量是否已经扭曲您的数字。
为什么内部流量的危害比您预期的更大
显而易见的问题是页面浏览量膨胀。但膨胀计数实际上是最无害的影响。更深层的危害出现在行为指标中。
当您访问自己的网站时,您的行为与真实访客完全不同。您在页面上花费更多时间(因为您在仔细审查它们),您导航到不寻常的 URL,您以真实用户不会采取的顺序访问页面,您从不转化——因为您实际上不是在尝试购买或注册。这意味着您的内部访问会拉高您的平均会话时长,降低您的转化率,并在您的热门页面报告中创建虚假流量模式。在一个有 500 个月访客和 200 个内部访问的网站上,您的分析并不描述您的受众——它描述的是您的受众和您自己的混合。
过滤内部流量的三种方式
基于 IP 的排除
最简单的方法是告诉您的分析工具忽略来自您控制的任何 IP 地址的访问。大多数分析平台在其设置中支持 IP 排除列表。您添加您的办公室 IP、您的家庭 IP 以及任何开发人员或质量保证 IP,这些访问者将无声地从所有追踪中排除。
缺点是基于 IP 的排除仅在您的 IP 是静态的并且事先已知时才有效。如果您或您的团队从多个位置、使用移动数据或在 IP 轮转的咖啡馆工作,排除列表会很快变得不完整。它也不适用于从未知 IP 访问网站的承包商或自由职业者。
基于 Cookie 或 localStorage 的选择退出
更灵活的方法是设置浏览器标志——无论是 Cookie 还是 localStorage 项——告诉追踪代码片段跳过从该浏览器记录访问。您向代码片段添加一个简单条件:如果标志存在,则退出而不发送任何数据。
主要优势是它跟随人而不是位置——只要您使用相同的浏览器,无论 IP 如何,过滤器都随您而动。缺点是它需要在您用于测试的每个浏览器中进行手动设置,它不会在您清除浏览器数据时存活,它仅对您有效,除非他们各自设置自己的标志,否则对队友无效。
用于经过身份验证的网站的基于角色的过滤
对于内部用户已登录的网站——客户门户、SaaS 产品或 CMS 后端——最可靠的方法是在检测到具有管理员或员工角色的用户时在服务器级别完全禁止追踪。因为您确切知道谁是内部用户(任何具有特定用户角色的人),您可以有条件地在服务器级别为这些会话排除追踪代码片段。
此方法最准确,因为它不需要为每个浏览器或 IP 进行手动设置,不会在团队成员更改位置时中断。它需要服务器端逻辑,但对于任何具有用户身份验证的网站,它是能够干净地扩展到整个团队的方法。
如何检查内部流量是否已经扭曲您的数据
在设置过滤器之前,值得量化问题。几个信号表明内部流量污染:
- 管理员或暂存页面出现在您的热门页面报告中。 如果仅员工定期访问的 URL 定期出现在前 10 名中,则说明正在记录内部访问。
- 流量高峰与您自己的工作时间一致。 如果您的"最忙时间"始终与您的团队在 CMS 中积极工作的时间相匹配,则该信号不是有机的。
- 跳出率对您的内容类型来说异常低。 员工访问通常涉及在单个会话中浏览多个页面,人为降低跳出率。
- 流量在周末下降但不是预期的模式。 如果您的受众应该包括全球用户,与特定时区工作周一致的急剧下降可能表明内部流量占主导。
了解机器人流量过滤以及内部流量过滤可以让您全面了解实际访问您的网站的人以及在您的数据中生成背景噪声的人。
总结
内部流量过滤是在您主动处理的网站上添加任何分析工具后要设置的首批事项之一。IP 排除处理简单情况;基于角色的禁止处理经过身份验证的应用的健壮情况。使用的方法不如有一个到位重要——因为任何未过滤的内部流量会悄悄腐蚀您依赖来做出决定的行为指标。首先审计您当前的数据是否已被污染,然后应用与您的团队访问网站方式相匹配的过滤器。