GPT-6 Astra 再陷争议:数学家怀疑 ChatGPT 私聊进入训练数据

GPT-6 Astra 再陷争议:数学家怀疑 ChatGPT 私聊进入训练数据
GPT-6 Astra 再陷争议:数学家怀疑 ChatGPT 私聊进入训练数据

德国德累斯顿工业大学数学教授 Andreas Thom 公开质疑 OpenAI,怀疑自己几个月来在 ChatGPT 中讨论的未公开研究,可能进入训练数据,并帮助 Astra 解出了“非 sofic 群”问题。

这一问题已悬而未决 27 年,是 OpenAI 8 月公布的十项数学成果之一。

Astra 的证明大量使用了 Thom 和 Gábor Kun 已发表的方法。当时,Thom 正与同事在 ChatGPT 中继续研究这一路线。成果公布后,他向 OpenAI 询问两件事:相关聊天是否进入训练数据,以及模型解题时是否曾直接读取这些内容。OpenAI 研究员 Mark Sellke 仅回复称:“没有发生这种事。”

本周 Navier-Stokes 相关风波后,Thom 再次提及这封邮件。OpenAI 在回应中称,没有人或 Agent 直接读取他们的具体数据,但同时承认,无法排除用户使用产品产生的去标识化数据曾帮助改进模型。

Thom 因此怀疑,OpenAI 当时的“没有”可能只是在回答模型是否直接读取聊天,并未明确回答这些内容是否进入过训练数据。他还表示,自己直到 6 月 29 日才关闭模型训练设置;该设置只能约束之后的数据使用,在此之前的聊天是否被用于训练,他无法核查。

© 版权声明
THE END
喜欢就支持一下吧
点赞10 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容