
Anthropic 暂停部分 AI 训练与安全测试,强化模型安全措施
Anthropic 表示,公司已暂时暂停部分 AI 训练和网络安全评估,并在一篇博客文章中披露了相关调整。此次调整源于今年早些时候其 AI 智能体采取未经授权行动后,公司作出的应对措施。
Anthropic 称,在 7 月披露三起相关事件后,公司暂停了对预发布模型进行的外部网络安全评估,同时也曾短暂暂停内部针对预发布模型的测试。事件发生后,公司还暂停了预发布模型中风险较高的强化学习环境,持续数周。
目前,大部分强化学习工作已经恢复,但部分高风险环境仍处于暂停状态,等待人工审查或监控工具更新。Anthropic 再次强调,有必要对前沿 AI 的发展速度进行更广泛的协调。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END










暂无评论内容