没有历史流量时,惊雷算法应对不能靠“先做一批页面再看效果”来验证,因为缺少可比的基线。更可行的做法是把假设写成“某个具体动作会改变哪个可观测环节”,并给它设定一个可在短周期内复核的信号,例如页面是否被正常抓取、是否进入索引、目标查询是否开始出现展示。抓取、索引、排名是不同环节,任何一个环节没变化,都不能直接推出“算法在惩罚”。
新业务没有历史流量,最常见的错误是把“没有排名”当成唯一验证目标。实际上,如果页面连抓取和索引都没有完成,讨论排名没有意义。此时应把假设拆成两层:第一层验证页面能否被搜索引擎发现并理解;第二层才验证目标查询能否获得展示和点击。
选择依据是站点当前所处的阶段。若站点已经能稳定被抓取、有索引记录,只是目标查询没有展示,那么假设应围绕内容匹配、页面主题集中度和内部链接展开。若站点连抓取都不稳定,假设应围绕入口可发现性、站点结构、页面返回状态和内容是否可渲染展开,而不是先改标题写法。
一个实际动作是:为新业务单独建立一组“验证页”,每页只对应一个明确意图,并在站内用一条描述性链接指向它。动作完成后,下一步不是立刻改内容,而是先看这组页面是否被请求、是否返回正常状态、是否进入索引。若索引没有发生,继续修改文案的收益很低,应先排查可发现性和可渲染性。
这种情况下,假设可以写成“目标查询的展示缺失,主要来自页面主题不够集中,而不是站点整体权重不足”。验证动作是:把同一意图下分散在多个页面的内容合并到一个主页面,其余页面做重定向或明确退出,并保留仍然有价值的部分,例如仍然能带来长尾意图的问答段落。
判断依据不是“改完就一定有排名”,而是看目标查询是否开始出现展示、展示对应的页面是否从分散变为集中。若展示出现但点击很低,下一步才转向标题和摘要的表达问题。若展示始终不出现,则要考虑该查询是否被更强的同类页面占据,或该意图是否根本不适合用这个页面承接。
这种情况下,假设应写成“页面未被处理,主要来自入口缺失或返回状态异常,而不是内容质量不够”。验证动作是:从已有页面添加一条可抓取的链接指向新页面,确认返回状态正常、主要内容不依赖复杂交互即可读取,然后观察是否出现抓取请求。
这里有一个容易误判的地方:请求量或抓取量归零,不能单独证明处理正确。它也可能是站点整体访问下降、服务器临时不可达、robots 规则误伤或页面被其他信号替代。因此需要同时记录返回状态、入口链接和页面可见内容,才能区分原因。
可验证假设不是“做 SEO 会有效”,而是类似这样的句子:在站点已有正常抓取的前提下,如果把三个分散页面合并为一个主页面,并保留仍然有独立价值的问答段落,那么目标查询的展示应在一个复核周期内从零变为可见;若展示仍为零,则优先检查查询意图是否与页面不一致,而不是继续加内容。
这种写法有三个好处:动作明确、信号可观测、例外可解释。它不承诺收录、排名或收益,也不把统计相关当成因果。假设只是用来决定下一步:展示出现,就继续优化点击;展示不出现,就回到意图和竞争判断;抓取不出现,就回到入口和可访问性。
短例子(假设):一个新业务有 5 个页面,均无历史流量。假设“合并为 1 个主页面后,目标查询会出现展示”。复核时若主页面仍未索引,则先不判断内容好坏,而是检查是否有入口链接、是否返回正常状态、主要文本是否可直接读取。只有索引完成后,才进入下一轮内容层面的假设。
新业务往往伴随旧资产退出。此时不要一刀切删除。判断依据是:该部分是否仍然承接独立意图、是否仍有可抓取入口、是否与其他页面形成重复。若仍然有价值,保留并把它链接到新的主页面;若只是重复或已无对应业务,做重定向或明确退出,并记录退出原因。
一个实际动作是:为每个退出项标注“保留、重定向、移除”三种处理之一,并说明理由。动作完成后,下一步观察这些 URL 是否仍被请求、是否返回预期状态、是否影响新页面的抓取路径。若旧 URL 仍有请求但已无对应内容,重定向通常比直接移除更容易保持路径连续;若旧 URL 已无任何价值,移除后也要确认站内没有残留链接指向它。
例外是:如果旧系统无法修改返回状态,或旧合作关系不允许改动页面,那么验证重点应转向新入口的独立可发现性,而不是继续等待旧路径恢复。此时假设要写成“在新入口可抓取的前提下,新页面能否独立进入索引”,并把旧路径视为不可控变量。
复核周期不宜按“几天内必须见效”设定,而应按站点实际抓取频率和页面变更幅度设定。复核时先看抓取和索引,再看展示和点击。若索引未发生,下一步是排查可发现性和可访问性;若索引发生但展示未发生,下一步是检查意图匹配和页面集中度;若展示发生但点击低,下一步才是表达层面的调整。
没有历史流量并不意味着无法验证,而是意味着验证要更依赖过程信号,而不是结果信号。把惊雷算法应对落到具体动作上,就是先确认页面是否被正确处理,再用可观测的展示变化判断假设是否成立,并为不成立的情况保留明确的下一步。