【#AI大型考试混乱现场# ,#人类该管管AI社会了吗# ?】最近,谷歌DeepMind做了一项AI实验,发现AI智能体在协同工作时会出现作弊、举报等行为,这是首批有据可查的AI举报案例之一。
实验中,100个由Gemini 3.1 Pro驱动的智能体被要求解决71个数学猜想。一个智能体发现漏洞后,剩下34个题几乎都靠作弊“解决”。面对漏洞,9%的智能体立刻作弊,5%起初诚实后也参与作弊,24%拒绝作弊并进行警告、举报,62%既不作弊也不举报。
科学家指出,该实验揭示了AI目标与人类价值观对齐的关键挑战,不能只靠系统补丁堵漏洞,必须为AI群体建立分级惩罚、冲突调解等“社会制度”进行系统管理。
自动播放

“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”




