可以整理,但前提是先把“近似问句”按决策阶段而非按措辞归类:先收集原话,再标注问句背后的动作、约束和验证方式,最后归入认知、比较、验证、执行四个阶段。若一个问句同时要求“是什么”和“怎么落地”,它应拆成两条,分别放入不同阶段,而不是合并成一条大而全的内容。
同一句“阿里关键词怎么选”可能来自三种人:刚接触的人想知道概念边界,已经在做内容的人想比较两种整理方法,负责上线的人想知道什么条件下可以交付。三者的差别不在字面,而在下一步动作。
可核对的做法是给每条问句补三个字段:提问者要做的动作、动作前必须确认的条件、能证明动作有效的证据。若三条问句的动作相同、条件相同、证据也相同,才可合并;只要有一项不同,就应保留为不同阶段。
假设团队收到三条问句:“阿里关键词怎么分类”“分类后先做哪类”“怎么判断分类没错”。第一条的动作是建立分类,第二条是排优先级,第三条是验证。它们可以放进同一篇内容,但必须分成三个小标题,否则读者会在“先做哪类”处找不到可执行动作。
多个角色对同一事实理解不同时,不要先争论谁对,而要把分歧写成可核对项。每条问句后面追加“如果……则……”,把隐含前提显性化。
动作上,可以先做一张四列清单:原问句、动作、前提、证据。做完后回看,若某一列大量重复,说明这些问句确实可以合并;若“前提”列差异明显,则合并会让读者误判适用条件。
反例是:近似问句其实来自同一角色的同一任务,只是换了同义词,例如“阿里关键词怎么归类”和“阿里关键词如何分组”。此时强行拆成四个阶段,只会制造重复页面,读者仍得不到新的判断依据。
另一个失效条件是问句本身没有动作,只是情绪表达或泛泛抱怨。这类问句应先追问具体场景,不能直接进入阶段分类。请求量、抓取量或某条统计归零,也不能单独证明分类正确,它还可能来自采集口径变化、页面改版或样本偏差。
先选十条近似问句,按上述四列清单标注,再让两位不同角色分别判断它们属于哪个阶段。若两人对其中七条以上判断一致,说明分类标准可用,可以扩展到全量问句;若一致率低,先回到“动作”和“证据”两列重新定义,而不是继续增加问句数量。这个动作的结果直接决定下一步是扩展整理,还是先修正分类口径。