从WordPress迁移内容到独立CMS,导出字段和链接怎么接
把 WordPress 的内容迁到独立 CMS,导出字段和旧链接怎么接住?迁移失败的表现通常不是文章丢了,而是三类细节:字段结构没落地,栏目和自定义字段变成一堆空值;关系丢了,分类和标签与新系统的对应靠手工补;旧地址没人接,外链进来的页面全部落到首页。按五步走能覆盖这三块:列对象、映射内容模型、定地址规则与跳转表、分批导入、导入后校验。
第 0 步:先列出要迁的对象
导出之前先把对象列清楚,WordPress 的导出文件里包含文章、页面、自定义文章类型、评论、自定义字段、分类、标签、自定义分类法和用户,范围可以按分类、作者、日期与状态收窄。
对着这份清单逐条决定去向:文章进文档模型,页面进单页,分类进栏目,标签进标签体系,自定义字段要落到字段定义上,评论看新系统是否保留历史。用户是否迁移取决于新站要不要沿用会员关系。
列对象时同时记下数量。导出后的条目数与源站条目数要能对上,对不上就要在第 3 步查原因,而不是等上线后被读者发现。
第 1 步:把自定义字段映射成内容模型
这一步是迁移里真正决定后期维护成本的地方。自定义字段在源站里是松散的键值对,同一类文章在不同栏目下可能有不同的字段组合,靠模板条件判断硬撑。
新系统侧要先用内容模型把这些字段固化下来:哪一类内容有哪些字段、哪些必填、哪些参与列表排序与筛选。AnQiCMS 支持自定义内容模型与自定义字段,做法是先按内容类型建模型,再把源站字段一一对应进去;找不到对应的字段先判断它是展示信息还是筛选依据,展示信息可以直接留在正文里,筛选依据必须建成字段,否则后面没法用。
| 源站对象 | 迁移去向 | 常见处理失误 |
|---|---|---|
| 文章 | 文档模型下的正式文档 | 状态没区分,草稿当正式发了 |
| 页面 | 单页面 | 当成普通文章,导航结构乱掉 |
| 分类 | 栏目 | 层级压平,二级分类变同级 |
| 标签 | 标签体系 | 与分类混用,关键词重复 |
| 自定义字段 | 内容模型字段 | 未建字段,信息只剩在正文里 |
| 评论 | 评论数据 | 直接丢弃,历史互动清零 |
| 用户 | 用户与分组 | 全部落成同一角色 |
第 2 步:确定新站地址规则与跳转表
地址规则要在导入之前定,因为导入时就要写进链接字段。新站的伪静态规则决定文章对外呈现成什么形式,常见是按栏目加日期加标识,或者直接按标识。规则一旦定下,就把旧站地址逐类写成映射表:文章类旧地址对应新地址,栏目类、标签类归档各自处理,带参数的地址统一收敛到规范形式。
跳转表按一对一写,全部用永久重定向接,不要整站跳首页。这一步偷懒,前面所有链接关系都会归零。
第 3 步:分批导入与抽查
批量导入有三条路可走:压缩包、表格文件,以及接口方式。AnQiCMS 支持 ZIP 压缩包与 Excel 表格批量导入文档,也提供 /api/import/archive 这一导入接口,按标题还能查询是否已存在,重跑时不必担心重复落库。
分批的原则是按风险而不是按数量平均切:先拿一个小栏目试跑,检查字段落地情况、正文里的内部链接、图片引用、发布时间;确认无误后再按栏目批量走。字段结构问题在小批次里能一眼看出来,全量导入后再改就要重跑一遍。
第 4 步:迁移后的三类校验
第一类是数量校验:源站导出条目数、导入成功数、实际可见条目数三个数要对得上,差额要能解释(通常是草稿、待审核与回收站内容)。第二类是链接校验:抽查正文内部链接是否已经指向新地址,分类页与标签页能不能正常打开,旧地址是否返回永久重定向。第三类是清单校验:站点地图只输出正式文档,新地址随后走链接推送提交一次,主动推送的对象是新地址而不是旧地址。
删除的旧内容不要一起搬。已经进回收站的文档恢复出来再单独决定去向,批量导入不应该把废弃内容带回新站。
常见问题
导出文件里的图片要不要单独迁?要。导出带的是图片地址而不是文件本身,素材要一起搬过去并改写引用,否则新站上线后全是外链图片。
评论历史值不值得迁?取决于站点是否靠互动留存。若迁,要先确认新系统的评论状态字段能对应,别把已删除或垃圾评论一起带进来。
迁移后排名会掉吗?只要旧地址一对一接住、内容主体没变,短期波动通常会回来。掉得多且持续,先查跳转表覆盖率而不是查内容。