把“怎么选”“多少钱”“哪个好”“可以吗”这类近似问句直接按字面分组,通常只能得到一堆语义重复的簇,无法判断用户处在了解、比较还是准备执行。更有效的做法是:先用问句里的约束条件和动作指向判断决策阶段,再决定这个词组该进入哪个阶段的页面,而不是继续扩写同义问句。下面按两种条件展开,并给出可落地的整理动作。
当大量近似问句都带有价格、时间、地点、资质、兼容性等限定词时,说明用户已经越过泛泛了解,开始用现实条件筛选方案。此时不要按“问句长短”或“出现次数”分组,而应按约束的可验证程度排列。
实施动作:在词库里为每条问句增加一列“约束词”,只填问句里真实出现的限定条件,不替用户补全。填完后按约束从模糊到具体排序,同一排序区间内的问句归入同一决策阶段。这个动作的结果会直接影响下一步:如果某个阶段积累了大量问句却缺少对应页面,说明内容缺口在那一层,而不是继续在认知层扩词。
例外:有些问句同时含多个约束,例如“外地户口、预算有限、两个月内能不能办”。此时以最晚出现的约束为准,因为用户通常是在前一个条件满足后才提出后一个条件。若无法判断先后,就单独标记,不强行归入某一阶段。
另一类近似问句看起来全是“哪个好”“推荐一下”“有什么区别”,字面差异很小。这种情况下约束条件缺失,不能靠限定词分阶段,而要转向问句背后的动作指向:用户是想理解概念、排除选项,还是准备下单或执行。
可区分的原因证据是动词和宾语的关系。例如“A和B有什么区别”指向理解差异,属于认知阶段;“A和B选哪个”指向排除选项,属于比较阶段;“A怎么开通”指向执行步骤,属于行动阶段。三者可能只差一两个字,但页面要回答的问题完全不同。
实施动作:把无约束问句逐条改写成“动作 + 对象”的短标签,例如“区别—A/B”“选择—A/B”“开通—A”。改写后统计每个动作标签下的问句数量。若“选择”类问句远多于“区别”类,说明读者已经过了科普期,下一步应优先补比较页,而不是继续写概念解释。
假设例子:某词库里“A和B哪个更稳”出现多次,同时“A和B的区别”也出现多次。若只按字面合并,会得到一个混杂簇。按动作指向拆分后,“区别”进入认知页,“哪个更稳”进入比较页,并额外标注“稳”是主观判断词,需要在页面中给出可验证的对比维度。这个拆分不保证流量变化,但能让后续内容决策有据可依。
如果词库里既有带约束的问句,也有无约束问句,不要试图用一套规则统一处理。取舍依据是:约束词是否足以区分用户处境。足以区分时,按约束成熟度分阶段;不足以区分时,按动作指向分阶段。两者混用时,先处理带约束的那批,因为它们的信息量更大,也更容易判断页面该写到什么深度。
需要避免的做法是:把“多少钱”“价格”“费用”当作三个不同阶段,或把“可以吗”“行不行”“能不能”机械拆开。这些近似问句如果约束和动作都相同,应归入同一阶段,否则词库会虚假膨胀,后续排期也会被重复项占满。
一个可执行的检查是:从每个阶段随机抽三条问句,尝试用一句话写出该阶段读者最需要的答案类型。如果写出来都是“解释是什么”,说明阶段没有拉开;如果分别写出“解释成本构成”“对比两种条件”“给出前置检查”,说明划分可用。
另一个检查是看例外问句的占比。例外过多,通常意味着约束词或动作标签定义得太细,需要合并;例外过少,则可能把不同阶段的问句强行压进了同一层。无论哪种情况,都不要用搜索量或抓取量的短期波动来证明划分正确,因为这些现象还可能来自索引波动、页面改版或外部链接变化,不能单独作为判断依据。
整理近似问句的最终目的不是把词库做多,而是让每一层决策都有对应的内容承接。先判断约束是否足够,再判断动作指向是否清晰,最后用例外比例回检。这个顺序能让词库从“问句堆积”变成可执行的阶段地图,也决定了下一篇内容应该写什么、写到什么程度。