当AI开始“说话”,人类语言的深层意义会被改变吗?
2026-08-05 11:24 澎湃新闻
研究推测,上述现象可能不是模型本身的原因,而是在人类反馈强化学习(RLHF)过程中由负责评估和引导模型的人类导致。那些“薪酬过低、压力过大、时间紧迫”的数据标注员,倾向于将使用复杂名词、书面词汇、客观抽象语法的回答评为“更专业、质量更高”,模型在不知不觉中被训练得更频繁地使用它们。
哈达克表示,相比语言不可避免地改变,更大的担忧在于长久以来内置于大语言模型中的偏见,以及这种偏见可能会潜在地放大并确认那些有害的、阻碍我们作为整个文明向前发展的态度或观念。
她说,已有报告指出,人们可能以加深自身错误认知的方式过度依赖AI系统。“在一个本就充满分歧与敌意的世界里,一个巨大的隐患是,那些看起来礼貌且中立的技术,到头来反而是在重新复制、甚至放大人类最糟糕的偏见与缺陷。”
本期编辑 徐滁
责编:蔡溦







