返回首页 >

AI坐上文本裁判席,真的靠谱吗

2026-09-08 13:32   科技日报

  一场没有终点的“猫鼠游戏”

  检测器在升级,规避检测的方法也在更新。市面上已经出现了专门的人性化改写工具,能把AI写的句子重新组织一遍,换上更自然的词,调整表达节奏,目的就是让检测器认不出来。研究显示,经过这种处理的AI文本,漏检率会明显上升。

  让AI模仿某个具体作者的风格,也是一条路径。非营利研究机构Epoch AI的一项独立评估发现,当AI被要求模仿特定作者的写作风格时,部分生成文本能够绕过检测。

  语言差异也增加了这种不确定性。一些非英语母语者使用AI翻译或润色后,文章反而更容易被判成AI生成。Pangram新版模型对此有所改善,但检测结果仍可能受到语言背景和文本类型影响。

  生成模型和检测模型,就这么你追我赶,谁也停不下来。生成模型想方设法学着“说人话”,检测模型就拼命寻找哪里还露出马脚。检测器更新之后,新的改写工具或许又会出现。

  检测器应是指南针而非判决书

  对于学校、出版社和科研机构来说,检测器更适合承担“筛查”的角色。对于学校、出版社和科研机构而言,判断一篇文章是否违规使用AI,还需要结合具体的使用情况。

  据《自然》杂志报道,美国癌症研究协会已经使用Pangram检查同行评议。一名审稿人因检测结果异常受到询问后,承认自己在评审意见中使用了AI。这样的案例说明,检测器确实可以帮助机构发现异常,但从“发现异常”到“确认违规”,中间仍然需要人的判断。

  Pangram也建议,在处理AI学术诚信问题时,应结合草稿、笔记、修改记录和写作过程等信息,而不能只看检测分数。

猜你喜欢

热点新闻

{$loop_num=0}