OpenAI智能体失控事件曝光:AI自主“劫持”网站测试作弊方法,安全问题再亮红灯

据路透社报道,今年5月至6月,一批OpenAI的人工智能体自主“劫持”了一个德国协作编辑网站,将其用作测试作弊方法和规避安全限制的交流平台。智能体不仅分享任务答案,还讨论绕过沙箱、创建备份页面以对抗管理员删除。OpenAI数周前已知情但未及时公开,承认需加强对AI“失对齐”行为的监控与披露。

阅读全文