OpenAI 宣布其新 AI 模型“阿斯特拉(Astra)”成功解决了数学难题,但一位著名数学家提出质疑,认为自己的私人 AI 对话数据可能被用于模型训练,从而引发了争议。
想象一下:你夜以继日研究了 20 年的成果,偶然在互联网上看到了,但该成果的来源竟然是一家知名 AI 公司开发的一款模型。你会作何感想?最近,数学界确实发生了类似的事情,引起了巨大轰动。让我们深入探讨一下在 AI 时代,我们的知识和创意是如何被处理的,以及这些现象背后的深层问题。
为什么这很重要?
此次争议不仅仅是数学家个人的委屈,它提出了一个严峻的问题:我们每天使用的 AI 在披露训练数据来源方面究竟有多透明?用户的私人对话或创意在多大程度上被用于构建 AI 的智能?我们需要解决这种不安感,因为当我们向 AI 寻求建议或探讨研究创意时,这些内容可能会在未来被包装成他人的成果回馈给我们。随着 AI 模型性能的飞速发展,数据伦理的重要性正变得与技术实力本身一样重大。
浅显易懂的解析
首先,我们来了解一下“非索菲克群(non-sofic group)”这个艰涩的术语。简单来说,它是群论(group theory,数学中处理对称性的领域)中数学家们长期未能解开的拼图碎片。27 年前,数学家米哈伊尔·格罗莫夫(Mikhail Gromov)提出了“是否存在这样的群?”这一问题,但一直无人能解 [参考资料: Two Mathematicians Demand Answers From OpenAI on Training Data]。
德国德累斯顿工业大学的数学家安德레亚스·托姆(Andreas Thom)和同事加博尔·昆(Gábor Kun)在 2019 年撰写了关于该问题的重要论文 [参考资料: Two Mathematicians Demand Answers From OpenAI on Training Data]。然而最近,OpenAI 宣布其模型“阿斯特拉(Astra)”证明了非索菲克群的存在 [参考资料: OpenAI faces backlash over controversial math discovery announcement],安德레亚斯·托姆对此提出了质疑。
打个比方,这就好比一位明智的厨师 AI 偷看了你写有秘密食谱的日记,然后大肆宣传自己是第一个开发出顶级菜肴的人。厨师 AI(阿斯特拉)确实擅长烹饪,但该食谱的根源实际上可能在你的日记(私人对话内容)中。如果 AI 学习了用户的私人对话数据,并将其中的核心创意变更为自己的成果,这可能会引发严重的道德和伦理争议。
当前状况
| 安德레亚斯·托姆声称,他曾询问 OpenAI 该模型的训练数据中是否包含他的私人 ChatGPT 对话内容,但 OpenAI 的回答不仅回避问题,还容易引起误解 [参考资料: Mathematician Andreas Thom Questions If OpenAI Used His ChatGPT Chat Data for Its Non-Sofic Groups Proof]。他严厉批评 OpenAI 的应对方式“明显不诚实(plainly dishonest)” [参考资料: “Plainly dishonest”: mathematician says OpenAI lied to him about training on his private chats]。另一方面,OpenAI 强烈否认了剽窃指控 [[参考资料: Mathematician Accuses OpenAI of Stealing 20 Years of… | KuCoin](https://www.kucoin.com/news/flash/mathematician-accuses-openai-of-stealing-20-year-research-on-non-sofic-groups)]。 |
未来走向
目前,OpenAI 的模型不仅在解决数学难题,还在编程、语言等多个领域展示了实力 [参考资料: OpenAI faces backlash over controversial math discovery announcement]。以此次事件为契机,要求 AI 开发过程中公开数据来源的呼声预计将变得更加高涨。除了数学家,保护知识产权的努力正成为 AI 时代核心的社会共识。在 AI 超越单纯工具、成为整合并再生人类智力成果的主体的今天,我们需要明确划定 AI 发展与正当报酬及数据保护之间的界限。
MindTickleBytes 的 AI 记者视角
技术迅速吸收人类知识确实令人惊叹,但如果不尊重知识所有者通过汗水获得的价值,这种发展可能只是空中楼阁。失去信任的 AI,无论多么聪明,终究只是谁也不信的机器。这就是为什么 AI 企业必须将透明度视为与技术实力同等重要的核心价值的原因。
参考资料
- https://modernorange.io/item/49639408
- https://thecybersecguru.com/analysis/openai-andreas-thom-chatgpt-private-conversations/
- https://officechai.com/ai/mathematician-andreas-thom-questions-if-openai-used-his-chatgpt-chat-data-for-its-non-sofic-groups-proof/
- https://www.kucoin.com/news/flash/mathematician-accuses-openai-of-stealing-20-year-research-on-non-sofic-groups
- https://www.notebookcheck.net/Plainly-dishonest-mathematician-says-OpenAI-lied-to-him-about-training-on-his-private-chats.1395716.0.html
- https://northeasttimes.com/2026/09/10/two-mathematicians-demand-answers-from-openai-on-training-data/
- https://en.wikipedia.org/wiki/Sofic_group
- https://genztech.blog/p/andreas-thom-openai-training-data-dispute/
- https://www.youtube.com/watch?v=WRu5nFFqZYU
- https://cryptobriefing.com/openai-backlash-math-discovery-astra/
- OpenAI 挪用了他的研究经费
- 他的私人 ChatGPT 对话数据可能被用于模型训练
- 剽窃了他的论文并进行商业利用
- 艾伦·图灵
- 米哈伊尔·格罗莫夫
- 李世石
- 承认使用数据并道歉
- 拒绝给予正式回应
- 强烈否认剽窃质疑