先给结论:不是工具坏了,而是你沿用了旧的输入规范。爱站查询这类工具通常把“查询对象”当作一个整体来解析,域名、带协议URL、带路径URL、带查询参数的URL会被归入不同处理分支。对象格式一变,输入规范就要跟着变,否则你拿到的是一份“对另一个对象”的报告,自然和预期对不上。
假设你过去习惯只输入裸域名,比如 example.com,记录下它返回的权重、收录相关数据,作为长期基线。某天你把输入改成了带路径的完整地址 https://www.example.com/blog/post-1,想看看某个栏目页的情况。结果发现返回的数据量明显变小,甚至某些指标显示为空。
直觉反应往往是“站点被降权了”或者“工具数据出问题了”。但更常见的原因是:这次查询的对象已经不是站点,而是单个页面。工具按页面维度取数,能覆盖的范围天然比整站小。你比较的是两个不同粒度的东西,结论当然对不上。
面对这种反差,可以先列出两种成立的解释,再找证据区分:
这两种解释指向完全相反的动作:A要求你接受粒度变化并调整对比基线;B要求你检查输入是否被工具改写,避免误读。
不要只看数字大小,要看可核对的痕迹:
https://www.example.com/this-path-should-not-exist-12345。如果返回结果和首页几乎一致,说明工具忽略了路径,按域名处理;如果返回空或报错,说明路径参与了对象识别。这三步不需要额外工具,只需要你留意返回内容里的对象描述,并做一次对照查询。做完之后,你就能判断当前输入规范是否与工具的处理方式匹配。
如果证据指向解释A(按页面取数),你的输入规范应该改成:
www 前缀、不带路径。如果证据指向解释B(路径被忽略),你的输入规范应该改成:
这里的关键动作是:先做一次对照查询,根据返回结果里的对象标识决定后续输入格式。这个动作的结果直接决定你下一步是调整对比基线,还是更换查询对象。
以上判断成立的前提是:你查询的是同一站点、同一时间段,且没有同时改动其他变量。如果期间站点本身发生了改版、迁移或 robots 调整,那么数据变化可能来自站点侧,而不是输入格式。此时输入规范的调整只能解决“对象对不上”的问题,不能解释站点侧的真实变化。
另外,不同工具对URL的归一化规则并不公开,具体行为需要以你实际使用的版本为准。遇到不确定的情况,用上面那组对照查询去验证,比猜测规则更可靠。