北京时间8月19日,OpenAI CEO萨姆·奥尔特曼(Sam Altman)表示,公司暂停了部分前沿模型的强化学习(RL)训练,以确保安全、对齐和监控能力能够跟上新一轮模型能力跃迁。 他提到,模型进展现在极其迅速,“如果我们觉得模型能力的发展速度超过了安全和对齐的步伐,我们将采取行动。” 根据OpenAI博客中的信息,公司暂停了面向部署的最新模型强化学习训练两周,目前部分工作已经恢复,但...
网页链接北京时间8月19日,OpenAI CEO萨姆·奥尔特曼(Sam Altman)表示,公司暂停了部分前沿模型的强化学习(RL)训练,以确保安全、对齐和监控能力能够跟上新一轮模型能力跃迁。 他提到,模型进展现在极其迅速,“如果我们觉得模型能力的发展速度超过了安全和对齐的步伐,我们将采取行动。” 根据OpenAI博客中的信息,公司暂停了面向部署的最新模型强化学习训练两周,目前部分工作已经恢复,但...
网页链接
精彩评论