先给结论:额度有限时,不要按“数量”取样,而应按“差异”取样。优先挑那些最可能改变你下一步动作的页面或词,而不是随机抓一批。一个可执行的最小动作是:先列出三到五组对照样本,每组只改一个变量,跑完后看差异是否稳定出现;如果差异不稳定,就不要据此调整全站策略。
第一种条件:你已经有明确假设,只是缺数据验证。比如怀疑某类模板页收录差,或某批词排名波动。这时样本要围绕假设挑,选同一模板下至少两个不同栏目、同一栏目下至少两个不同层级,形成对照。第二种条件:你还没有假设,只是想看整体状况。这时不要均匀铺开,而要先按“页面类型×流量档位”切四到六个格子,每格抽一到两个代表。均匀铺开看起来公平,但信息量最低,因为每个格子都只有一两个点,任何异常都无法区分是个例还是普遍现象。
随机抽样适合估计总量,不适合判断原因。额度少的时候,你的目标通常不是估计总量,而是判断“这个变化是不是真的”。所以样本要能互相解释。假设你想知道改标题是否影响点击,不要随机抽二十个页面,而是找五组“内容主题相近、原排名区间相近、只有标题不同”的页面,每组两个。跑完后比较组内差异和组间差异。如果组内差异大于组间差异,说明标题之外的因素更主要,下一步应该先控制那些因素,而不是继续改标题。
这个动作的结果会直接决定下一步:差异稳定,才值得扩大样本;差异混乱,就应该换假设,而不是加大查询量。
反过来,最不值得优先查的是:已经长期无流量、无排名、无内链的页面。它们即使有变化,也很难归因,占用的额度却和关键页面一样多。
假设你有两类产品页,A类有五十个,B类有五十个,额度只够查二十个。不要各查十个。先各查三个,确认两类页面的收录状态和主要词排名区间是否真的不同。如果两类看起来一样,就没必要继续分类型抽样,把剩余额度集中查那些有流量波动的页面。如果两类明显不同,再各补三到五个,确认差异不是由个别页面造成的。这个例子里的数字只是说明比较方法,不是推荐配额。
样本有差异,不等于全站有差异;样本没差异,也不等于全站没问题。查询量下降、抓取量归零或某类页面查不到结果,都可能有多种解释:权限不足、查询对象写错、数据延迟、工具本身限流,或者那批页面本来就没有被处理。额度有限时,最稳妥的下一步是记录你选样本的依据和观察到的差异,等有更多额度时优先复测那些“差异稳定但样本少”的组,而不是急着下全站结论。