# AI做SEO最大的风险是什么？

URL: https://caijiao.org/posts/185
Source: docs/posts/185.md
Description: 不是"被检测出来"，这个担心在 2025 年已经过期了。真正的风险是站点级别的连坐：4.6.5 规模化内容滥用会拉低整个域名，4.6.4 则针对寄生在高权重站里的不相干栏目。

先排除一个流传很广的答案：**不是被检测出来。**

Google 官方在这件事上的表态相当明确——AI 生成本身不违规，违规的是为了操纵排名而规模化生产没有增量的内容。既然"是不是 AI 写的"不在判定口径里，担心识别率就是担心一件不存在的事。市面上那些 AI 检测工具给出的分数，和你的排名没有任何关系。

## 检测这件事为什么是个伪问题

Google 在这件事上的口径这两年没有变过：它关心内容有没有帮助，而不是内容由谁写。既然标准是帮助性，任何第三方检测给出的 AI 概率就不进入这套判定——那是用另一个标准算出来的东西。

实际被处理掉的站点，大多不是因为"看起来像 AI"，而是因为**内容里没有任何别处找不到的东西**——这才是 4.6.6 要管的。担心检测，不如担心同质化。

把这条排除掉之后，剩下的风险其实更少、更集中，也更难挽回。

## 最大的那条：判定单位已经变成整个域名

2025 年的一次调整把内容质量的评估信号提升到了**整站级别**。

这件事的影响被大多数人低估了。单页面评级的时候，一个坏栏目最坏的结果是那个栏目没人看；整站评级之后，一个坏栏目会把域名上其他页面的表现一起压下去。

这改变了对成本的计算。以前做坏一百篇的代价是"浪费了写这一百篇的时间"，现在的代价是"搭进去这个域名过去几年攒的东西"。风险和收益不再对称。

还有一件回滚时才知道的事：把那一百篇删掉之后，站的其他部分不会自动恢复到之前的水平。站点级别的评价是基于一段时间的行为形成的，不是撤销输入就能重算的。

对应的政策条目是 4.6.5 Scaled Content Abuse，它的措辞针对的是"大量生产低投入、低原创性、缺乏编辑加工"的内容。注意这三个词：**大量、低投入、缺乏编辑**。命中不需要三条占满，规模化本身就是一个被单独点名的特征。

## 第二条只对结构复杂的站成立：寄生

Site Reputation Abuse（4.6.4）管的是另一件事：把第三方内容放到一个高权重的站上，借用这个站的排名信号。

这条容易被理解为"接了广告稿"，实际覆盖面更宽。一个长期做某类技术内容的站，如果某天开始批量发某个完全无关的题材——方向和主页毫无交集、只是看好那个词的流量——**结构本身就在触发这条判定**，哪怕每一篇都写得不错。

相关性在这里是硬条件。具体到操作上，我给自己定的判据是：这个栏目能不能向一个新访客解释清楚它和主站其余内容的关系。解释不清，就说明它借的是主站的权重，而不是主站的主题。

已经堆了不相关栏目的情况，补救办法是把那部分整体迁到独立域名，并且不留任何跳转——跳转本身就在传递排名信号。

## 第三条：最低评级不需要「没用」，只需要「没增量」

4.6.6 那条规定了 Lowest 评级的触发：复制、改写或者 AI 生成，**且没有增量内容**。

很多人把这条读成"原创即安全"，其实标准比原创高。文章可以百分之百是自己写的、查重零命中，但里面每一句都能在排名前十的结果里找到等价物——这种情况下照样命中 4.6.6，因为缺的是增量，不是查重率。

## 还有一个不太被提的风险：你自己会停止判断

长期批量生成之后，我察觉到一个变化——开始不大确定自己能不能独立写出一篇完整的东西了，因为很长一段时间里都是"它出稿我改"。

这不会触发任何一条政策，但代价是真实的。内容最终依赖的是做东西的人手上有没有真东西，一旦材料源被外包，上限就由输入决定。

我的做法是保留一部分完全不用的活自己写。产量低一些，但它是判断力的来源。

## 我在实际项目里做的三件隔离

第一件，**不同题材分开域名**，而不是塞进同一个站的不同目录。这条最笨，但它是唯一能真正挡住整站连坐的做法。如果你手上已经有一个积累了几年权重的域名，别拿它实验。

第二件，**给每一批内容设"（真实素材 / 总篇数）"这个比例**，低于某个数就停。这个比"每篇都要原创"更好执行，因为原创是主观的，素材来源是可核查的。

第三件，元数据层面的检查要自动化。结构化数据是少有的**可以被机器判定对错**的部分，用 [JSON-LD 结构化数据](/json-ld/)里的字段做校验，能挡掉一批低级错误。

具体症状怎么看：抓取量突然掉、某些目录长时间不被收、页面进了索引却始终排得非常靠后——这些信号要在 [Google Search Central](/google-search-central/) 里对照官方文档逐项排查，不要凭感觉归因。同一次排查通常还会顺带发现渲染问题，那部分要在 [JavaScript](/javascript/) 一侧单独确认，因为抓取到的 HTML 有时候和你想象的完全不是一回事。

做完这三件，剩下的风险就只剩"内容真的不好"——那是个正常的产品问题，不是生存问题。

---

*引用政策来自 Google 搜索质量指南 4.6.4（Site Reputation Abuse）、4.6.5（Scaled Content Abuse）、4.6.6（Lowest Quality），以及 Google 官方关于 AI 生成内容的公开说明。*
