Alexa排名分析原本解决的是一个很具体的问题:在缺乏公开流量数据的年代,广告主、投资人和站长需要一把粗略的尺子,来判断一个网站的相对受欢迎程度。它衡量的不是真实访问人数,而是安装了Alexa工具栏的用户在浏览该网站时的相对行为,再折算成一个全球或分地区的名次。所以它回答的从来不是“这个网站有多少流量”,而是“在这套抽样样本里,它排在第几”。
最常见的误解是:Alexa排名第5万的网站,访问量一定比第10万的大一倍,或者可以直接换算成日IP。这并不成立。排名是一个相对序数,不是计数器。第5万和第10万之间的实际流量差距,可能远大于或远小于两倍,取决于当时样本的分布。把序数当基数用,是当年很多投放决策出错的根源。
另一个误解是认为排名越靠前越“权威”。排名靠前只说明在Alexa样本中访问集中度更高,而样本本身偏向特定浏览器插件用户、特定地区和特定人群。一个面向技术人员、访问者习惯装插件的站点,排名可能被高估;一个面向移动端或封闭生态的站点,排名可能被严重低估。
这三项需求都建立在“相对比较”上,而不是“绝对测量”上。理解这一点,才能理解它为什么会被误用,也能理解它为什么最终被更直接的流量与行为数据取代。
如果你手头只有历史排名数据,要做出可用的判断,可以按下面的顺序处理:
判断结果时,可以问自己一句:这个结论如果换一套样本,还成立吗?如果答案是否定的,就说明它只能作为线索,不能作为定论。
Alexa Internet 的排名服务属于历史概念,其工具栏抽样机制和公开排名页面不应被当作今天仍然可用的流量查询入口。公开 PR 值同样属于历史指标,且第三方仿值不能视为 Google 官方数据。百度快照、SOSO 等也应按待核实的历史功能对待,不要假定其当前入口或更新机制。
需要核查一个站点现状时,可行的做法是:查看该站自己公开的流量声明及其口径,查看广告平台或分析工具中你自身可访问的数据,查看是否有独立第三方监测机构的公开报告。任何一项单独数据都不足以定论,需要说明它测量的是什么、样本是谁、时间范围多长。
下一步,如果你正在处理一个具体的排名异常或数据矛盾,先把手上所有排名记录按“来源、口径、时间”三列整理成一张表,再决定哪些可以互相比对,哪些必须丢弃。