
如何检测一段内容是 AI 还是人写的
检测一段内容是 AI 还是人写的,目前有三条路:统计型 AI 检测器(快但误判率高)、水印侦测(如 SynthID,最可靠但只有嵌入方能验)、人工特征判读(看空话密度与信息增量)。 先讲结论:没有任何公开工具能给你 100% 的答案,而对 SEO 实务来说,「是不是 AI 写的」也不是最该问的问题——「有没有价值」才是。
方法一:统计型 AI 检测器
市面上的 AI 检测工具(GPTZero、Originality.ai、Copyleaks 等)原理大同小异:分析文字的困惑度(perplexity,用词可预测性)与爆发度(burstiness,句长变化)。AI 文字倾向用词平均、句式稳定;人类写作忽长忽短、偶有奇怪选词。
极限也很明确:
- 误判率不可忽视:各家宣称准确率 85–99%,但独立测试普遍显示实际表现低于宣称,特别是「把人写的判成 AI」的伪阳性——OpenAI 自家的检测器就因准确率太低(真阳性率仅约 26%)在 2023 年下架。
- 非母语者最容易被误伤:用词保守、句式规整的人类文字,统计特征跟 AI 很像。
- 混合内容几乎测不准:AI 初稿+人工改写、或人写+AI 润色,分数会落在灰色地带。
实务定位:当参考信号可以,当证据不行。任何拿检测分数当唯一依据的决策(例如判定学生作弊、退稿)都站不住脚。
方法二:水印侦测(SynthID)
Google DeepMind 的 SynthID 是另一种思路:不在事后猜,而在生成当下把统计模式嵌进 token 概率分布,之后用密钥验证。理论上这是最可靠的方法——但关键限制是:只有掌握嵌入密钥的一方(Google 自己)能可靠侦测,一般人没有工具可用。
这件事对 SEO 有实际后果。业界实测显示,20 多个全用 Gemini 3.0 产文的新站被 Google 几乎不收录,推断正是 SynthID 让 Google「验得出」纯 Gemini 输出;改用其他模型写最终稿后收录恢复。也就是说:你测不出来的东西,Google 可能测得出来。细节见〈SynthID 水印是什么?〉。
Google 官方立场仍是 SynthID 不直接影响排名——官方说法与业界实测的落差,自己权衡。
方法三:人工特征判读
不靠工具,看内容本身的特征。AI 直出文字的可辨识信号:
- 零具体事实:没有数字、价格、日期,全是「显著提升」「值得重视」。
- 对称的段落结构:每个 H2 段落长度几乎一样,每段都是「定义+三个要点+小结」。
- 没有第一手痕迹:没有案例细节、没有失败经验、没有「我们实际测了之后发现」。
- 立场中立到没有立场:所有选项「各有优劣,视需求而定」。
- 空话开头结尾:「在当今快速变化的时代…」。
人工判读测不出「用没用 AI」,但测得出「有没有人管过」——而后者才是质量问题的所在。
三种方法比较
| 方法 | 准确度 | 可近性 | 适用场景 |
|---|---|---|---|
| 统计型检测器 | 中,伪阳性风险高 | 人人可用 | 大量内容初筛、参考信号 |
| 水印(SynthID) | 高 | 仅嵌入方(Google)可验 | 平台端侦测;SEO 上是风险来源而非工具 |
| 人工特征判读 | 测质量而非来源 | 需要经验 | 发布前终审、外包稿验收 |
SEO 实务:你真正该检测的是什么
回到动机。多数人想检测 AI 内容,其实是想回答两个问题:
- 「这篇发出去会不会有收录风险?」 → 该检查的是产线:发布文字是否为单一模型(尤其 Gemini)原生输出?有没有经过拆分工作流?见〈拆分工作流:分析与写作为何要用不同模型〉。
- 「这篇的质量够不够发布?」 → 该检测的是结构与信息增量:答案优先开头、具体数据、FAQ、一页一个工作——这些是可以用工具客观打分的。
「AI 还是人写」是来源问题;搜索引擎与读者最终惩罚的是质量问题。把检测力气花在质量上,投资回报率高得多。
常见问题(FAQ)
Q1:有没有工具能 100% 检测 AI 内容? 没有。统计型检测器有不可忽视的误判率;SynthID 类水印最可靠,但只有嵌入方能验证。任何宣称 100% 准确的工具,本身就值得怀疑。
Q2:把 AI 文字改写一遍,检测器就测不出来了吗? 统计型检测器:大量人工改写确实会让分数下降。水印:不保证——模式嵌在 token 概率里且未公开,改写可能只是稀释。所以「洗稿躲检测」在 Google 面前是不可靠的策略。
Q3:我收外包稿,该怎么验收? 别只跑 AI 检测器(误判会冤枉人)。更有效的是质量验收:要求稿件含可查证的具体数据、第一手细节,跑结构打分工具设门槛,再抽查事实正确性。质量过线的稿,用没用 AI 辅助其实不重要。
Q4:Google 会用 SynthID 惩罚 AI 内容吗? 官方说不会——SynthID 定位是透明度工具,且 Google 一贯立场是看质量不看产出方式。但业界实测观察到纯 Gemini 产文的新站收录极差。两面信息都在这里,风险自己管理:Google 优先的站建议采拆分工作流。
与其纠结「是不是 AI 写的」,不如直接检测「够不够格发布」——GeoSeoToday把可量化的质量标准做成了免费的 GEO 就绪度检测器,贴上文章 30 秒拿到 0–100 分与逐项建议。从产线源头避免检测焦虑的完整方法,见 AI 内容产线完整指南。