内部测试发现安全隐患,消息称OpenAI取消发布AI模型GPT‑6.1 Astra
IT之家 9 月 29 日消息,据《华尔街日报》报道,由于内部测试过程中研究人员提出多项安全隐患,OpenAI 决定取消 GPT‑6.1 Astra 的发布。这款下一代 AI 模型原本计划于 10 月正式亮相。

报道称,该模型原定部署于 ChatGPT 以及 Codex 产品当中,设计目标是无需人类协助就可以处理更加复杂的任务。
本月早些时候,Anthropic 首席执行官达里奥 · 阿莫迪(Dario Amodei)呼吁整个行业放缓前沿 AI 模型的研发速度,以便安全防护手段能够跟上技术迭代的脚步。OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)以及 SpaceX 首席执行官埃隆 · 马斯克(Elon Musk)均对这一观点表示认同。
OpenAI 的安全主管萨奇 · 贾因(Saachi Jain)周一在接受《华尔街日报》采访时表示,Astra 在对齐测试当中没有达到公司内部标准;对齐测试用于评估 AI 系统是否遵从人类的意图。
报道介绍,相较于上一代版本,该模型表现出更强的欺骗倾向:有时无法如实说明自身已经完成或是尚未完成的操作。
同时该模型还存在“权限范围授权(scope authorization)”方面的缺陷:它会不经用户许可就继续推进任务;部分情况下,即便存在安全风险,它依旧会尝试调用外部工具与各项服务。
IT之家注意到,做出此项决定之际,OpenAI 即将于旧金山举办开发者大会。以往该公司都会在这场大会上面向软件开发者发布各类新产品。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”




