# Google到底怎么看待AI生成内容？

URL: https://caijiao.org/posts/173
Source: docs/posts/173.md
Description: Google 的官方立场是 AI 生成本身不违规，违规的是为操纵排名规模化生产无增量内容。对应三条政策：4.6.4 站点声誉滥用、4.6.5 规模化内容滥用、4.6.6 低投入内容，后者评级为 Lowest。

Google 对这件事的表述其实一直很稳定，只是被转述得越来越失真。原话的意思是：**AI 生成本身不违规，违规的是为了操纵搜索排名而规模化生产没有增量价值的内容。**

这句话里有两个限定词，缺一个都不成立。

## 两个限定词各自在排除什么

第一个是"为了操纵排名"。这排除了所有非 SEO 用途的 AI 生成内容——产品文档、代码注释、邮件草稿、内部知识库，这些不在讨论范围内。Google 没有立场去管你怎么写邮件。

第二个是"没有增量价值"。这排除了有实质内容的 AI 辅助创作。一篇用 AI 起草、但包含实测数据和个人判断的文章，不在违规范围内。

两个限定词合起来，指向的是一种很具体的行为：批量生产那些"看起来像内容、但不提供任何新信息"的页面，目的是占住搜索结果的位置。

判定不看工具，看产出物。Google 也从来没有要求站点声明内容是否由 AI 生成——这个要求不存在。

## 三条政策条目，管的不是同一件事

常被混为一谈的有三条，它们各自的适用范围很清楚。

Site Reputation Abuse（4.6.4）管的是内容和宿主站的关系。第三方内容寄生在一个有排名信号的主机上，借用宿主权重获取排名，而宿主对内容没有实质的编辑参与或监督。判断依据是内容主题和站点主题的相关性，不取决于内容本身写得好不好。

Scaled Content Abuse（4.6.5）管的是生产规模和投入。大量页面、低投入、低原创性、缺乏编辑判断。这里的"大量"不是数字门槛，是相对于产出过程中的人工投入而言。

MC Created with Little Effort（4.6.6）管的是内容本身的质量底线。复制、改写、自动生成，且没有增量价值。这条的评级是 Lowest——质量评级体系里的最后一档。

这三条是独立的。一篇内容可以同时落在两条里，也可以只落在一条里。混淆它们的后果是改错了地方：内容和站点主题无关的问题，靠提高内容质量解决不了。

## Lowest 评级意味着什么

质量评级体系里，Lowest 描述的是"这类内容被视为没有价值"，不是"排在最后一名"。

实际后果是这类页面在大多数查询里不会被展示，同时它们会作为负样本参与站点层面的质量评估。也就是说，它们不只是自己没流量，还会成为判断整个站点的依据之一。

Lowest 不是永久标签，这一点对已经踩坑的站点很重要。内容经过实质修改、有了真实增量之后，评级是可以变化的。这也是为什么清理和重写比新建更有价值——同样的工作量，用在修改上能同时消除负样本。

## 2025 年整站信号之后，实际差别在哪

Helpful Content 系统在 2025 年升级为整站级别的信号。这个变化之前的常见做法是"新建一个子目录做实验，做坏了也不影响主站"。现在这个想法不成立。

差别具体体现在两处：一是低质量内容的影响范围从单页扩大到整站参与评估；二是评估的持续性——不是一次性的算法更新，而是持续运行的信号，意味着修改之后需要一段时间才能看到评估变化，不是改完立刻生效。

对规模化生产的站点来说，这个变化的实际含义是：试错成本变高了，先小批量验证再铺开，比一次铺完再修补划算。

## AI 能用在哪几个环节

划一条线：能用在你有能力验证的环节，不能用在你无法验证的环节。

可以用的：代码生成和重构，跑一遍就知道对不对；批量数据整理和格式转换，结果可比对；初稿起草，前提是后面有人做实质修改；把已有结构化数据转成页面文案，前提是文案有人审。

要谨慎的：直接产出面向用户的最终内容，尤其是那些你本人没有第一手经验的领域——你无法判断 AI 写的是否准确，也就无法判断它有没有增量。

不该用的：生成那些"只是为了有页面"的页面。这类页面从一开始就没有任何验证手段，只能等几个月后的搜索数据，而那时已经铺了几百上千页。

## 一条可以自己判的标准

不看工具、不看流程，只看产出物：

这一页相对网上已有的同类内容，多了什么具体的、可验证的东西？

能答上来的——多了一组自己跑出来的数据、多了一个具体的实现细节、多了一个明确的时间点或版本信息——就没什么可担心的，不管它是不是 AI 参与写的。

答不上来的，不管花了多少人工，都属于"低投入内容"的范畴。

站点的实际表现只有自己能看到，[Search Console](/google-search-central/02-search-console-setup) 里的展现、点击和索引状态是唯一的一手数据。政策细节建议顺着 [Google Search Central](/google-search-central/) 的原文看，二手解读经常把三条政策混成一条。

具体到页面层面，结构化数据的标记同样只应该描述页面上真实存在的内容，具体写法见 [JSON-LD](/json-ld/)。这一条在 AI 参与生成内容时尤其容易被忽略——生成的内容和生成的标记可能都不对应任何真实存在的东西。

---

*Google 政策条目编号（4.6.4 Site Reputation Abuse、4.6.5 Scaled Content Abuse、4.6.6 MC Created with Little Effort）及 2025 年 Helpful Content 整站级信号，均引自 Google Search Central 官方文档。*
