Files
SEONexus/docs/gpt-template-seo/16-GPT模板多源协作边界与真实启用核查-2026-05-01.md
2026-05-26 17:21:51 +08:00

177 lines
6.3 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# 16 GPT模板多源协作边界与真实启用核查 2026-05-01
## 1. 多源协作边界
当前部署边界:
- GPT 模板:当前共有 `3` 套源。
- 老模板 `1001-1005`:当前共有 `4` 套源。
- 当前这套 `SEONexus` 是 GPT 模板主要测试源。
代码修改规则:
1. GPT 模板所有代码修改只能在当前主测试源做。
2. 其它 GPT 源只允许拉取主测试源已验证代码,不能单独改代码。
3. 其它 GPT 源发现问题时,只能把优化记录、蜘蛛日志、收录/爱站反馈写回文档。
4. 老模板也必须固定一个测试优化源;其它老模板源只拉取和反馈。
5. 禁止在多个源同时试不同 SEO 代码,否则无法判断是哪一个动作影响了蜘蛛和收录。
一句话:
> 当前源负责“试代码和出结论”,其它源负责“拉取、跑数据、回传反馈”。
## 2. GPT 模板优化是否已经开始使用
### 2.1 已经进入页面渲染链的部分
`videoGpt1` 已经在前台页面使用 `seo_copy`
| 页面 | 使用位置 | 判断 |
|---|---|---|
| 首页 | `videoGpt1/index/index.html` | 已使用 `scene="home"` |
| 搜索页 | `videoGpt1/video/getSearchVideo.html` | 已使用 `scene="search"` |
| 分类频道页 | `videoGpt1/video/getCategoryType.html` | 已使用 `scene="category_index"` |
| 分类列表页 | `videoGpt1/video/getCategory.html` | 已使用 `scene="category_list"` |
| 榜单页 | `videoGpt1/video/getRankIndex.html` / `getRankList.html` | 已使用榜单补料 |
| 详情页 | `module/detail_main/desc.html` | 已使用 `scene="detail"` |
| 播放页 | `video/getVideoPlayUrl.html` | 已使用 `scene="play"` |
前台读取链路:
1. 模板调用 `{video:seocopy ... /}`
2. 标签进入 `VideoService::getSeoCopyBlock(...)`
3. 优先读取 `code/data/seo_copy_published/{host}/{scene}/{page}.json`
4. 缺失时回退到 `code/data/seo_copy/{host}/{scene}/{page}.json`
5. 再缺失时用 `SeoCopyFallbackBuilder` 兜底,避免页面空白。
### 2.2 已经进入 TKD 的部分
首页、分类、搜索等页面的 TKD 已经不是只靠旧标题池:
1. `site:seotkd` 调用 `SiteContext::getSeoTkd(...)`
2. 首页、搜索页、分类页、榜单页优先读域名记录和已发布 `seo_copy`
3. 详情/播放页保留新池、旧池、域名记录的兼容兜底。
所以“AI 文案 / 引导文案”并不是只停在文件里,已经进入前台页面输出。
## 3. 发现的真实断点
本次核查发现一个关键问题:
> `seo_copy` 已经在用,但 `keyword_feedback` 之前主要停在数据产物层,没有充分反哺到运行时页面承接。
具体表现:
1. 爱站/百度反馈已经生成到 `code/data/seo_resource/keyword_feedback/`
2. `hot_keywords.latest.json``by_host/*.json` 里有域名级反馈。
3. 但运行时 `VideoService::getSeoCopyBlock(...)` 原本不读取这些反馈。
4. 结果就是:采集到了“哪些词有反馈”,页面却没有自动增强对应承接。
这会导致一个 SEO 问题:
- 文案系统在工作。
- 蜘蛛日志在跟踪。
- 爱站/百度在回传信号。
- 但三者没有形成闭环,页面承接容易落后于真实出词方向。
## 4. 本次已做代码修正
只在当前 GPT 主测试源修改:
- [VideoService.php](/www/wwwroot/diff-maccms/SEONexus/code/app/services/VideoService.php)
新增运行时闭环:
1. 首页、分类、搜索页补料块读取当前域名的 `keyword_feedback/by_host/*.json`
2. 优先使用爱站关键词;没有爱站词时,使用域名导入关键词兜底。
3. 将近期外部反馈写入页面补料块 `_keyword_feedback`
4. 在页面导览卡片中增加“近期检索方向”。
5. 在辅助说明里补一句近期重点承接方向。
边界:
1. 不改老模板。
2. 不改其它 GPT 源。
3. 不批量改标题。
4. 不替换原 AI 文案,只做反馈增强。
5. 只增强首页、分类、搜索这类承接页,不动详情/播放页主体逻辑。
## 5. 为什么当前效果仍然感觉不行
从 Day1/Day2 数据看,不是“完全没优化”,而是优化还没有形成稳定正循环。
当前问题优先级:
1. 百度 `site:` 采集质量差,`failed` 空 payload 和 captcha 混在一起,导致判断失真。
2. Day2 蜘蛛回落,`detail + play` 明显变少,深页接力弱。
3. `301 / 403 / 444` 占比仍高,蜘蛛预算被消耗。
4. 爱站只看到 `zbsv3.com` 有明确增量,其它出词站没有稳定扩张。
5. 外部反馈原本没有自动进入页面承接,本次已补。
## 6. 接下来 SEO 推进原则
当前不要平均推 32 个站。
第一优先级:保住已出词站
- `zbsv3.com`:保现有词,不大改主标题;只补首页承接、内链、详情入口。
- `sdxhtgcl.com / sdxtwnc.com`:先复核掉词真假,再决定是否扩词。
第二优先级:把深抓站做成第二批正样本
- `sjzyunyang.com`
- `codohealth.com`
- `jingxifa.com`
- `lgyz.net`
动作:
1.`detail/play` 不断。
2. 首页补回深页入口。
3.`301/403/444`
4. sitemap 保持可访问。
第三优先级:修风险站
- `cnzhenbang.com`
- `oronorent.com`
- `visitsumenep.com`
- `sdtljq.com`
- `stsgf.com`
动作:
1. 只修入口、canonical、robots、sitemap。
2. 不加词。
3. 不扩标题。
## 7. 每日闭环
每天只看四件事:
1. 蜘蛛:`baiduspider / bytespider / sogou``home / detail / play / sitemap / robots`
2. 异常:`301 / 403 / 444` 是否下降。
3. 百度:`site:` 结果必须区分 `indexed_like / no_result / captcha / empty_failed`
4. 爱站:出词域名数和 PC 词总数,不只看历史反馈池。
执行节奏:
1. 当前源先改。
2. 当前源跑 24-48 小时。
3. 看蜘蛛和站外反馈。
4. 有效再同步其它 GPT 源。
5. 其它源只写反馈,不单独试代码。
## 8. 今日结论
GPT 模板的 AI 文案和引导文案已经开始使用,但之前没有把外部反馈真正接入运行时页面承接。
本次已把 `keyword_feedback` 接入 `VideoService::getSeoCopyBlock(...)`,让爱站/百度反馈能进入首页、分类、搜索页的可见内容层。
后续判断效果时,不再只看“有没有写文案”,而要看:
1. 蜘蛛是否继续抓这些承接区。
2. 已出词站是否保住。
3. 深抓站是否转收录。
4. `301/403/444` 是否降下来。