先给结论:如果长文里每个部分都能独立回答“用户此刻要完成什么”,优先按用户任务拆分;如果各部分是同一任务下必须顺序理解的层层概念,才按概念拆分。判断依据不是字数,而是读者能否在缺少前后文时仍然用得上其中一段。你手上如果只有一个页面和一份词表,也足以做出这个判断:把现有小标题改写成任务句或概念句,看哪些能独立成立。
不需要后台数据或权限,打开你正在犹豫的那篇文章,把每个小标题抄下来,逐条改写成两种版本:一种是“用户要做什么”,一种是“这个概念是什么”。例如原标题“聚类结果处理”,任务版是“拿到聚类结果后先合并还是先拆页”,概念版是“聚类与分组的区别”。改写过程本身就是证据:如果某个小标题只能写成概念句,写不出对应的用户动作,说明它依赖上下文,单独拆出去会变成半截文章。
这个动作的结果会直接影响下一步。若超过一半小标题能自然写成任务句,且彼此之间没有先后依赖,就按任务拆;若多数只能写成概念句,且必须按顺序读,就保留在同一篇里,用<h3>分层,而不是拆成多篇。
任务拆分成立,需要同时满足三点:每段有独立的触发场景、读者不需要读完前一段才能用后一段、拆出的页面各自有明确的下一步动作。典型信号是,同一批词里出现了“怎么做”“先做哪个”“出了问题怎么办”这类不同阶段的问法,而它们并不共享同一套前置知识。
假设你有一篇讲“页面合并与拆分”的长文,里面同时包含判断标准、操作步骤、拆错后的补救。这三块可以分别对应三种读者状态:还在犹豫的人、已经决定要动手的人、已经拆错要回退的人。此时拆成三篇,每篇都能独立给出下一步;如果硬留在一篇,犹豫的人会被操作细节劝退,动手的人又要翻过判断部分。
要注意一个不能推出的结论:拆完后各页的抓取量或请求量变化,不能单独证明拆分正确。请求量下降也可能是内链减少、入口调整或抓取节奏变化造成的,需要结合页面是否仍能独立完成任务来判断。
概念拆分成立的条件相反:各部分共享同一套前提,必须按顺序理解,且拆开后每篇都会缺失定义或边界。判断方法是问一句“只读这一节的人,能不能知道这个概念在解决什么问题”。如果答案是不能,说明它更适合留在原页,用层级标题组织,而不是独立成篇。
例如一篇解释“聚类与分组差异”的文章,前半是意图归类,后半是词面归并,两者都服务于“怎么判断两个词该不该放一起”这一个任务。把它们拆成两篇,读者会分别看到半套判断标准,反而要来回跳转。这种情况按概念分层更合适:主页面承担完整判断链,子标题承担概念递进。
这个流程的产出不是最终分组,而是一份可验证的拆分草案。执行后如果发现某页仍然要靠另一页才能读懂,说明这一步拆早了,应退回合并,而不是继续加解释段落。
没有搜索量、点击率或权限,仍然可以完成上述改写和分组,因为判断依据是读者任务是否独立,而不是流量大小。你可以用现有词表、页面小标题和读者提问记录作为替代材料。但要注意:缺少数据时不能推出“某组词一定更值得单独成页”,也不能用“拆完后某页没被收录”来反推拆分错误,因为收录与抓取还受入口、内链和站点状态影响。最小动作是先把任务句写出来,再决定合并还是拆开;这个动作的结果只用于判断页面结构,不用于预测流量。