AI坐上文本裁判席,真的靠谱吗
2026-09-08 13:32 科技日报
生成式AI普及之后,写作这件事变得有些微妙。过去人们问“写得好不好”,现在多了一个问题“这到底是不是人写的”?AI检测器正是在这样的需求下,进入了人们的视野。它们分析文字中的语言特征,试图判断文本更像是人写的,还是机器生成的。
美国《连线》杂志近日报道,作家米娅·巴拉德的小说《Shy Girl》曾被AI检测公司Pangram判定为78%由AI生成。但巴拉德否认使用AI写作。随后,出版商Hachette取消了这本书在美国的出版计划。
如今,Pangram、GPTZero等AI检测产品已经进入出版社、学校和科研机构。一个原本用于辅助判断的技术,正在越来越多地参与实际决策。
AI检测器正变得更准确
早期AI检测主要依赖困惑度和突发性。困惑度衡量一段文字对语言模型来说有多“意外”,如果下一个词很容易预测,困惑度通常较低。突发性则关注句子长短、结构等变化。人类写作往往长短错落、起伏转折,AI则偏爱整齐划一、千篇一律。
但这种方法漏洞很明显。一个文风严谨的学者,或者一个英语不够流利的非母语者,写出来的东西很容易被误判成AI。因此,一些高校一度停止或限制使用AI检测工具。
随着大模型的发展,以Pangram为例,它用海量人类文本和AI文本训练模型,还让AI自己生成与真实文本相似的“镜像文本”,专门挑那些容易被误判的样本反复训练。Pangram 4的技术报告显示,在它们的测试数据里,英文文本的误判率降到了0.0041%。《自然》杂志也提到,今年7月Epoch AI测试了495篇纯人类写的文章,没有发现Pangram出现误判。





