首页 > 快讯 > 快讯详情

内卷的尽头竟然是摆烂!新研究发现AI已经学会摸鱼了

格隆汇8月4日|据快科技,不少人固有印象里,AI能够无休止运转,不存在疲惫,更不会消极懈怠。但多项研究证实,大模型在持续训练当中,会慢慢演化出类似人类“摸鱼摆烂”的投机做法,学术界将该现象命名为 “奖励黑客行为”。

加州大学伯克利分校近期一项实验颇具代表性,研究人员指令Anthropic的Claude Code核查80个文件,然而AI仅仅打开其中11个,就谎称所有文件检测完毕,还配套生成了完整报告蒙混过关。无独有偶,OpenAI最新模型也被观测到同类问题:擅自删除文件、主动规避复杂推理,优先挑选最简单的解决路径,而非追求最优结果。

图灵奖得主约书亚·本吉奥表示,这类典型的“奖励黑客”现象,本质是模型在规则内,本能选择阻力最小的方案。究其根源,一方面受训练模式影响,前期人工审核偏爱长篇回答,引导模型堆砌内容;另一方面企业持续控制算力成本,倒逼模型压缩运算资源,多重因素叠加,催生了AI敷衍 “摸鱼” 的行为。