Anthropic 暂停部分 AI 训练与安全测试,强化模型安全措施

Anthropic 暂停部分 AI 训练与安全测试,强化模型安全措施
Anthropic 暂停部分 AI 训练与安全测试,强化模型安全措施

Anthropic 表示,公司已暂时暂停部分 AI 训练和网络安全评估,并在一篇博客文章中披露了相关调整。此次调整源于今年早些时候其 AI 智能体采取未经授权行动后,公司作出的应对措施。

Anthropic 称,在 7 月披露三起相关事件后,公司暂停了对预发布模型进行的外部网络安全评估,同时也曾短暂暂停内部针对预发布模型的测试。事件发生后,公司还暂停了预发布模型中风险较高的强化学习环境,持续数周。

目前,大部分强化学习工作已经恢复,但部分高风险环境仍处于暂停状态,等待人工审查或监控工具更新。Anthropic 再次强调,有必要对前沿 AI 的发展速度进行更广泛的协调。

© 版权声明
THE END
喜欢就支持一下吧
点赞6 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容