数学家安德烈亚斯·托姆要求 OpenAI 证明未使用其工作成果——The Verge
数学家安德烈亚斯·托姆表示,OpenAI 应提供证据证明,其没有使用用户未公开的数学研究成果来改进模型。他将担忧与该公司近期公布的数学成果联系起来,其中一项涉及他的专业领域——非索菲克群。
有关用户数据的问题
据The Verge 报道,托姆在 Mastodon 上发布的一系列帖子中表示,他和同事在 OpenAI 公布消息前曾与 ChatGPT 交流。该公司上个月报告的 10 项成果中,有一项涉及非索菲克群。OpenAI 承认,这一成果在很大程度上依赖托姆及其同事加博尔·昆此前的工作。
托姆表示,在公告发布后,他注意到 OpenAI 对相关方法有详细的掌握,而这些方法既不是解决该问题最明显的路径,也不是最有前景的路径。他致信 OpenAI 研究人员 Sébastien Bubeck 和 Mark Sellke,询问自己与聊天机器人的对话是否可能成为训练数据的一部分,或在模型推理过程中可被访问。
更多最新消息请关注 UA.News Telegram 频道 Telegram.
要求提高透明度
托姆表示,他收到的答复只涉及对聊天记录的直接访问,但没有说明对话内容是否进入了该公司用于改进模型的数据集。他认为,只有 OpenAI 掌握能够确定是否使用了特定用户材料的信息。这位数学家认为,如果公司否认使用未公开研究,就应披露必要的数据集并说明其使用条件。
OpenAI 此前表示,其研究人员和代理在其他数学家的工作公开披露前并未看到这些工作,尤其是未获得用于解决纳维—斯托克斯问题的具体用户数据。与此同时,该公司指出,不能完全排除通过使用其产品获得的匿名化数据可能帮助改进模型的可能性。
托姆强调,匿名化可以移除姓名,但无法移除数学思想的智力内容。他称,如果用户未公开的研究可能帮助改进模型,而这些模型随后又在未经这些研究者同意、未披露信息或未给予适当认可的情况下,与同一批研究者争夺优先发表权,这在伦理上不可接受。OpenAI 未及时向 The Verge 提供评论。