# 1296-SEONexus 老模板 Sitemap Patch 模板 - 2026-04-17
## 目的
这份文档专门服务第一批 5 个 `sitemap-main.xml` 文件。
适用文件:
- `videoDadi/sitemap/sitemap-main.xml`
- `videoDingZhu/sitemap/sitemap-main.xml`
- `videoBoKu/sitemap/sitemap-main.xml`
- `videoLaoNiu/sitemap/sitemap-main.xml`
- `videoNuNu/sitemap/sitemap-main.xml`
它的目标不是一步做成终极 sitemap,而是给主 Codex 一份“先止损、先收口”的 patch 模板。
## 一、这 5 个文件当前共同问题
5 套文件当前完全同构,问题也完全一致:
1. host 使用 `https://www.{$DomainModel->d_domain}`
2. 页面逻辑明显像小说站:
- `novel:category`
- `novel:sort`
- `novel:status`
- `site:nflurl`
这意味着当前 `sitemap-main.xml` 至少存在两层问题:
- host 口径和页面主输出不一致
- 页型逻辑本身很可能就不属于视频站
## 二、为什么第一批不建议“直接重建完整视频 sitemap”
因为第一批当前更重要的是:
- 先停止输出错误信号
- 先停止 sitemap 自己制造 `www` 级跳转
如果现在就直接重建完整视频 sitemap,会立刻引入这些风险:
- 需要重新确认视频分类页、榜单页、详情页到底要进哪些
- 需要确认对应模板是否都已有稳定最终 URL
- 需要确认分页和去重策略
这会让第一批从“快速止损”变成“大重构”。
## 三、第一批最稳策略
### 策略名:最小正确集
第一批建议把 `sitemap-main.xml` 收缩成只保留:
1. 首页
2. 榜单首页
同时完成两件事:
- 去掉 `www`
- 删除整段明显错误的小说站逻辑
## 四、为什么这个策略是当前最稳的
因为现在 `robots.txt` 已经统一指向:
```txt
Sitemap: https://{$DomainModel->d_domain}/sitemap_index.xml
```
也就是说:
- `robots.txt` 已经在告诉蜘蛛“请走裸域 sitemap”
但 `sitemap-main.xml` 还在吐:
```xml
https://www.{$DomainModel->d_domain}
```
这本身就在制造冲突。
所以第一批先做:
- `robots.txt` 继续保持不动
- `sitemap-main.xml` 收口到与它一致
这是最容易立刻减少内部冲突的一刀。
## 五、推荐 patch 思路
### 当前错误版本的典型结构
当前文件大致是:
```xml
https://www.{$DomainModel->d_domain}/
...
https://www.{$DomainModel->d_domain}{$strRankUrlTemp}
...
{novel:category ...}
{novel:sort ...}
{novel:status ...}
https://www.{$DomainModel->d_domain}{site:nflurl ... /}
...
{/novel:status}
{/novel:sort}
{/novel:category}
```
### 第一批建议改成
保留首页和榜单页,但去掉 `www`:
```xml
https://{$DomainModel->d_domain}/
{:date('Y-m-d')}
daily
1.0
https://{$DomainModel->d_domain}{$strRankUrlTemp}
{:date('Y-m-d')}
daily
1.0
```
## 六、推荐 patch 结果的优点
这个“最小正确集”版本有 4 个优点:
1. 不再输出明显错误的小说站路径
2. 不再继续输出 `www`
3. 不需要先设计视频分类 sitemap 结构
4. 最容易快速验证是否减少 `/|301` 和 host 级冲突
## 七、当前不建议在第一批做的事
下面这些更适合第二批:
- 把视频分类页全部灌进 `sitemap-main.xml`
- 把详情页或播放页直接灌进 `sitemap-main.xml`
- 在 `sitemap-main.xml` 里处理复杂分页
- 重新设计多 sitemap 分片策略
不是这些没价值,而是它们更适合在第一批止损之后做。
## 八、和 `robots.txt` 的关系
当前 5 套 `robots.txt` 的最后一行已经统一是:
```txt
Sitemap: https://{$DomainModel->d_domain}/sitemap_index.xml
```
因此第一批 patch 的原则是:
- 让 `sitemap-main.xml` 向 `robots.txt` 靠齐
- 而不是反过来去改 `robots.txt`
这也是为什么当前建议:
- `robots.txt` 暂不主改
- 主改 `sitemap-main.xml`
## 九、建议验收方式
每改完 1 个 `sitemap-main.xml`,先做最小验收。
### 页面源代码验收
确认:
1. XML 可以正常访问
2. 首页 `` 是裸域,不是 `www`
3. 榜单页 `` 是裸域,不是 `www`
4. 文件里不再出现:
- `novel:category`
- `novel:sort`
- `novel:status`
- `site:nflurl`
### 域名级优先验收
优先看:
- `sctyjz.com`
- `www.ap-hulan.com`
- `hymdrz.com`
## 十、验收后的日志观察
改完这 5 个 sitemap 之后,连续看 3 天最值得盯的是:
1. `/|301` 是否下降
2. `home|301` 是否下降
3. host 分裂是否开始减轻
## 十一、一句话交接
> 老模板第一批 sitemap patch 的核心不是“马上做大做全”,而是先让 sitemap 不再输出明显错误的小说站路径,不再自带 `www` 级冲突;只要先把 sitemap-main 收成最小正确集,就已经是在给百度减损。