
OpenAI 首席科学家回应 Astra 争议:新架构并未让模型突然变成“黑箱”
OpenAI 首席科学家 Jakub Pachocki 近日回应了外界对 Astra 循环架构的部分解读。他表示,包括 Astra 在内,OpenAI 当前的前沿模型,其计算图深度与 GPT-4 相比最多只相差约 2 倍,并没有突然增加几个数量级。
这一回应主要针对《The Information》此前的报道。报道称,Astra 使用 recurrent depth,即让同一组 Transformer 层反复计算。部分推理因此可能发生在模型内部,而不必全部以思维链形式写出,这也引发了外界对模型是否会变得更难监控的担忧。
Pachocki 承认,CoT(思维链)监控确实较为脆弱,并且相关趋势正在向更难监控的方向发展。但他强调,这一问题并不取决于模型架构变化。OpenAI 从第一代推理模型开始就一直保留并使用 CoT 监控,目前仍将增强这项能力列为核心研究目标。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END










暂无评论内容