先不要改标题。把导入后的文章列表按“文件原始名—页面标题—正文首句”三列并排,逐行核对哪一列发生了整体偏移;通常是导入器把文件名当作标题、把首段当作摘要,或模板把标题字段读成了固定值。确认偏移规律后,再决定是修数据还是修模板,这一步决定了后面返工量的大小。
打开导入日志或后台列表,随机抽十条,记录每条的文件名、页面标题和正文首句。如果十条里标题都等于文件名去掉扩展名,那是导入映射问题;如果只有部分条目错,且错位位置不固定,更可能是文件本身缺少标题字段,导入器用了兜底值。
这两种情况的处理方向不同:
如果抽样十条里两种现象都有,说明源文件格式不统一,优先统一格式,而不是先动模板。
把源文件按目录列出来,对照导入后的页面标题,做成一张两列的核对表。假设你有 30 篇草稿,文件名是日期加序号,标题是中文短语。导入后发现页面标题全部变成了“2024-05-01-01”这类字符串,那偏移点就在“文件名被当成了标题字段”。
反过来,如果页面标题是空的,正文却完整,偏移点在“标题字段没有被读取”。这两种偏移的修复动作不同:前者要改映射来源,后者要检查字段名是否与导入器预期一致。核对表的作用是让你在改任何配置前,先知道错在哪一层。
多人协作时,常见分歧是“标题没错”和“标题错了”同时存在,因为各自看的页面不同。把分歧转成三个可核对的点:
<title> 是什么;三个位置分别记录一次,就能判断是列表缓存、模板渲染还是数据本身的问题。例如列表页标题正确、详情页标题错误,说明模板读取了另一个字段;两处都错,说明数据层没写对。这个动作的结果直接决定下一步是清缓存、改模板还是重导数据。
改完映射或模板后,不要只看修复的那一条,用原来抽样的十条重新核对三列。如果十条全部对齐,再抽另外十条确认没有引入新偏移。若仍有错位,记录错位条目在源文件里的共同点,比如都缺少某个字段、都来自同一个子目录。
这里要注意:一次修复后标题正确,不等于导入流程已经稳定。如果源文件后续还会新增,建议在导入前先用一小批样本试跑,确认字段映射无误后再批量导入。这个动作能把返工范围控制在样本内,而不是等全部导入完再逐条改。
第一,浏览器或后台列表的缓存可能让你看到旧标题,核对前先强制刷新或换一个无缓存窗口。第二,如果标题里包含特殊字符,导入器可能做了转义或截断,导致看起来像错位,实际是字符处理问题。这两种情况都会让你误判偏移原因,所以核对时要把原始文件内容和页面显示内容并排看,而不是只凭记忆判断。
把核对动作固定成“抽样—记录—对照—再抽样”的循环,比一次性检查全部条目更容易发现偏移规律,也更容易让不同角色对同一批数据得出相同结论。