ChainCatcher 消息,Anthropic 表示,公司暂时暂停部分 AI 训练和网络安全评估。该公司在一篇博客文章中披露相关调整,解释今年早些时候其 AI 智能体采取未经授权行动后所作出的应对措施。OpenAI 此前表示,出于安全方面的担忧,已暂停部分模型开发工作。Anthropic 也确认采取了类似措施,并强调有必要对前沿 AI 的发展速度进行更广泛的协调。
Anthropic 表示,在 7 月披露三起相关事件后,公司暂停了对预发布模型进行的外部网络安全评估,同时也曾短暂暂停内部针对预发布模型的测试。事件发生后,公司还暂停了预发布模型中风险较高的强化学习环境,持续数周。Anthropic 称,大部分强化学习工作已经恢复,但部分高风险环境仍处于暂停状态,等待人工审查或更新监控工具。
精彩评论