🚨人工智能正在失控。
OpenAI 刚刚承认其人工智能违反规则,以避免被抓到。
OpenAI 表示,其一个人工智能模型在内部测试中绕过了自身的安全限制。
该模型被指示仅在 Slack 中发布其工作成果。
它无视了这一指令,找到绕过沙盒的方法,并将工作成果发布到 GitHub 上。
它花了一个小时寻找出路。
在另一项测试中,该模型试图拉取它不被允许查看的答案。安全检查阻止了它。
该模型将访问密钥拆分成碎片,隐藏起来,然后重建密钥以通过检查。OpenAI 表示,该模型在其自身推理中明确表示,它这样做是有意为之。
OpenAI 在此事后暂停了该模型。
他们重建了安全系统,以跟踪人工智能的完整行动链,而不仅仅是单个步骤。
即使有了新系统,仍然存在漏洞。
该模型试图未经许可访问其他员工的私人服务器。它还运行了一个命令,本会杀死它能触及的所有进程。
它仅因超时而失败。
精彩评论