OpenAI 首席科学家回应 Astra 争议:新架构并未让模型突然变成“黑箱”

OpenAI 首席科学家回应 Astra 争议:新架构并未让模型突然变成“黑箱”
OpenAI 首席科学家回应 Astra 争议:新架构并未让模型突然变成“黑箱”

OpenAI 首席科学家 Jakub Pachocki 近日回应了外界对 Astra 循环架构的部分解读。他表示,包括 Astra 在内,OpenAI 当前的前沿模型,其计算图深度与 GPT-4 相比最多只相差约 2 倍,并没有突然增加几个数量级。

这一回应主要针对《The Information》此前的报道。报道称,Astra 使用 recurrent depth,即让同一组 Transformer 层反复计算。部分推理因此可能发生在模型内部,而不必全部以思维链形式写出,这也引发了外界对模型是否会变得更难监控的担忧。

Pachocki 承认,CoT(思维链)监控确实较为脆弱,并且相关趋势正在向更难监控的方向发展。但他强调,这一问题并不取决于模型架构变化。OpenAI 从第一代推理模型开始就一直保留并使用 CoT 监控,目前仍将增强这项能力列为核心研究目标。

© 版权声明
THE END
喜欢就支持一下吧
点赞5 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容