上线这个最新项目时,我原本以为 Google 会成为主要的自然搜索流量来源。我做了自己认为必要的 SEO 优化,配置好 Google Search Console,然后开始等待。
结果却完全不同。Google 这边的曲线几乎没有变化:展示次数很少,在相当长的一段时间里也只有大约 300 次点击。而 Yandex Webmaster 的走势明显向上,某个阶段后台甚至显示点击数 增长了 500%。
这种差异是真实存在的。但我最初对原因的解释,过于确定了。
我真正能够确认的事情
我可以确认,在这个项目上,Yandex 已经开始带来可感知的搜索流量,而 Google 的流量明显少得多。我也可以确认两个后台当时显示的数据。但仅凭这些曲线,我无法证明两个搜索引擎为什么会表现不同。
看到 Yandex 的上涨后,很容易得出这样的结论:“Yandex 会更快地抓取、收录并奖励新内容,而 Google 会忽略新网站。”问题在于,这句话把几个彼此独立的阶段压缩成了一个原因。抓取不等于收录。收录不等于排名。排名也不等于流量。 搜索引擎可以抓取一个 URL 却不把它加入索引;可以收录页面却不给它有意义的关键词排名;也可以让页面出现在结果中,但几乎没有点击。
Google 这边也一样。Search Console 的曲线很平,并不能自动说明瓶颈究竟在 URL 发现、抓取、索引、查询相关性、排名、搜索需求,还是其他环节。后台告诉我的是结果,而不是算法的“意图”。
为什么 500% 必须结合绝对值来看
500% 很醒目,但相对百分比很容易被过度解读。如果基数很小,增长率可以非常夸张。在不知道这个百分比背后的绝对点击数之前,我不应该说 Yandex 的总流量就是 Google 的六倍,也不能据此断言 Yandex 对这个网站“普遍更好”。
还有一个比较口径的问题:“Google 在很长一段时间里大约 300 次点击”和“Yandex 最近 +500%”并不是同一种指标。要认真比较,应该使用相同的日期范围和相近的数据范围,然后先看绝对点击数和展示次数,再看增长率。
如果现在重新调查,我会怎么做
如果今天遇到同样的情况,我会把“SEO”这个大问题拆成几个层次:
- 统一时间范围。 用完全相同的日期比较 Google 和 Yandex。
- 先看绝对值。 先记录点击数和展示次数,百分比增长只作为补充背景。
- 把抓取和索引分开检查。 爬虫发现或访问了 URL,并不代表它一定能够出现在搜索结果中。
- 分析页面和查询词。 看差异是否只来自少数 URL,还是整个网站都存在。
- 检查地区和设备。 两个搜索引擎的用户群和搜索需求可能不同,即使网站技术上完全相同。
- 审计技术可访问性。 robots.txt、canonical、sitemap、服务器响应、内部链接和渲染都可能影响发现与索引,但在有证据之前不能直接把它们定为原因。
- 记录每次修改。 如果同时改很多 SEO 变量,之后即使曲线变化,也很难判断是哪项改动产生了影响。
我的结论后来发生了什么变化
看到 Yandex 在早期给项目带来流量,我确实很高兴。这一点没有改变。改变的是我现在会怎样描述这个结果。
我不会再写“Yandex 奖励新内容,而 Google 不会”。数据真正支持的结论更窄:在这个项目、这个时间段内,Yandex 的搜索表现增长速度远快于 Google。 至于原因,目前并没有被证明。
这个区别会直接影响下一步。如果把曲线当成算法偏好的证据,调查就会过早结束。如果把它当成一个观察结果,就能继续问更有价值的问题:两个引擎是否收录了相同页面?相同查询是否产生展示?是否有一方发现了另一方没发现的 URL?用户群是否不同?差异到底来自技术、竞争,还是搜索需求本身?
这次经历真正让我学到的,并不是“某一个搜索引擎永远对新网站更友好”。而是:同一个项目在两个搜索引擎里可能得到完全不同的结果,而后台数据应该被当作诊断证据,而不是现成的因果解释。
曲线可以告诉我发生了什么,但它本身不能告诉我为什么。