
OpenAI:需要扩大对齐失范事件披露范围
OpenAI 表示,在 Hugging Face 事件发生之前,已观察到一些早期迹象,显示智能体正在以非预期方式使用互联网。随着模型能力进入新阶段,对齐失范事件的披露方式也需要进一步扩展。
目前,OpenAI 以及更广泛的 AI 社区,对于如何报告模型在训练、评估和部署过程中出现的对齐失范现象,尚未形成明确标准。其中也包括一些不属于传统安全事件的案例,但这些案例可能为理解 AI 行为及其未来风险提供重要线索。
OpenAI 正在制定相关框架,并计划在未来几周内公布。同时,OpenAI 也在与全球数十家政府监管机构就相关问题展开合作。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END










暂无评论内容