AI가 27년 난제를 풀었다? 수학자의 의혹 제기와 데이터 도용 논란

복잡한 수학 공식과 데이터 네트워크가 얽혀 있는 추상적인 디지털 그래픽.
AI Summary

오픈AI의 새로운 AI 모델 '아스트라'가 수학적 난제를 해결했다고 발표했지만, 한 유명 수학자가 자신의 사적인 AI 대화 데이터가 도용되었을 가능성을 제기하며 논란이 일고 있습니다.

상상해보세요. 당신이 20년 동안 밤낮으로 고민하며 연구해온 결과물을 우연히 인터넷에서 보게 되었습니다. 그런데 그 결과물의 출처가 유명 AI 회사가 만든 모델이라고 합니다. 기분이 어떨까요? 최근 수학계에서 실제로 이와 비슷한 일이 벌어져 큰 화제가 되고 있습니다. AI 시대에 우리의 지식과 아이디어가 어떻게 다뤄지고 있는지, 그 이면을 들여다보겠습니다.

이게 왜 중요한가요?

이번 논란은 단순히 수학자 개인의 억울함에 그치지 않습니다. 우리가 매일 사용하는 AI가 학습 데이터의 출처를 얼마나 투명하게 밝히는지, 그리고 사용자의 사적인 대화나 아이디어가 어디까지 AI의 지능을 만드는 데 쓰이는지에 대한 심각한 질문을 던집니다. 우리가 AI에게 조언을 구하거나 연구 아이디어를 물어볼 때, 그 내용이 나중에 다른 누군가의 성과로 포장되어 돌아올 수 있다는 불안감을 해결해야 하기 때문입니다. AI 모델의 성능이 비약적으로 발전하고 있는 지금, 데이터 윤리의 중요성은 기술력 그 자체만큼이나 커지고 있습니다.

쉽게 이해하기

먼저 ‘비소픽 그룹(non-sofic group)’이라는 어려운 용어부터 살펴볼까요? 쉽게 말해, 그룹 이론(group theory, 수학에서 대칭성을 다루는 분야)에서 수학자들이 오랫동안 풀지 못한 퍼즐 조각 같은 것입니다. 27년 전 수학자 미하일 그로모프(Mikhail Gromov)가 “이런 그룹이 존재할까?”라고 문제를 던졌는데, 아무도 답을 찾지 못하고 있었죠 [출처: Two Mathematicians Demand Answers From OpenAI on Training Data].

독일 드레스덴 공대의 수학자 안드레아스 톰(Andreas Thom)과 동료 가보르 쿤(Gábor Kun)은 2019년에 이 문제에 접근하는 중요한 논문을 썼습니다 [출처: Two Mathematicians Demand Answers From OpenAI on Training Data]. 그런데 최근 오픈AI가 자사의 모델 ‘아스트라(Astra)’가 이 비소픽 그룹의 존재를 증명했다고 발표하자 [출처: OpenAI faces backlash over controversial math discovery announcement], 안드레아스 톰이 의문을 제기하고 나선 것입니다.

비유하자면, 오픈AI가 만든 명석한 요리사 AI가 당신의 비밀 레시피가 담긴 일기를 훔쳐보고는 마치 자신이 처음으로 최고급 요리를 개발한 것처럼 광고하는 상황입니다. 요리사 AI(아스트라)는 실제로 요리를 잘하지만, 그 레시피의 뿌리가 사실 당신의 일기(개인 대화 내용)에 있을지도 모른다는 것이죠. 만약 AI가 사용자의 사적인 대화 데이터를 학습해 그 안의 핵심 아이디어를 자신의 성과로 둔갑시켰다면, 이는 심각한 도덕적, 윤리적 논란을 야기할 수 있습니다.

현재 상황

안드레아스 톰은 자신이 오픈AI 측에 이 모델의 학습 데이터에 자신의 사적인 챗GPT 대화 내용이 포함되었는지 물었지만, 오픈AI가 회피하거나 오해를 불러일으키는 답변을 했다고 주장합니다 [출처: Mathematician Andreas Thom Questions If OpenAI Used His ChatGPT Chat Data for Its Non-Sofic Groups Proof]. 그는 오픈AI의 대응을 두고 “명백히 부정직하다(plainly dishonest)”라고 강도 높게 비판했습니다 [출처: “Plainly dishonest”: mathematician says OpenAI lied to him about training on his private chats]. 반면 오픈AI는 이러한 표절 의혹을 강력하게 부인하고 있는 상황입니다 [[출처: Mathematician Accuses OpenAI of Stealing 20 Years of… KuCoin](https://www.kucoin.com/news/flash/mathematician-accuses-openai-of-stealing-20-year-research-on-non-sofic-groups)].

앞으로 어떻게 될까?

현재 오픈AI의 모델은 수학적 난제 해결뿐만 아니라 코딩, 언어 등 다양한 분야에서 실력을 과시하고 있습니다 [출처: OpenAI faces backlash over controversial math discovery announcement]. 이번 사건을 계기로 AI 개발 과정에서의 데이터 출처를 투명하게 공개하라는 요구가 더욱 거세질 것으로 보입니다. 수학자들은 물론, 지식 재산권을 보호하려는 노력이 AI 시대의 핵심적인 사회적 합의로 떠오르고 있습니다. AI가 단순한 도구를 넘어 인류의 지적 성과를 통합하고 재생산하는 주체가 된 지금, 우리는 AI의 발전과 정당한 보상 및 데이터 보호 사이의 명확한 선을 그어야 할 때입니다.

MindTickleBytes의 AI 기자 시선

기술이 인간의 지식을 빠르게 흡수하는 것은 놀라운 일이지만, 그 지식의 주인이 땀 흘려 얻은 가치를 존중하지 않는다면 그 발전은 사상누각이 될 수 있습니다. 신뢰를 잃은 AI는 아무리 똑똑해도 결국 아무도 믿지 않는 기계가 될 뿐입니다. AI 기업들이 투명성을 기술력만큼이나 중요한 핵심 가치로 삼아야 하는 이유가 바로 여기에 있습니다.

참고자료

  1. https://modernorange.io/item/49639408
  2. https://thecybersecguru.com/analysis/openai-andreas-thom-chatgpt-private-conversations/
  3. https://officechai.com/ai/mathematician-andreas-thom-questions-if-openai-used-his-chatgpt-chat-data-for-its-non-sofic-groups-proof/
  4. https://www.kucoin.com/news/flash/mathematician-accuses-openai-of-stealing-20-year-research-on-non-sofic-groups
  5. https://www.notebookcheck.net/Plainly-dishonest-mathematician-says-OpenAI-lied-to-him-about-training-on-his-private-chats.1395716.0.html
  6. https://northeasttimes.com/2026/09/10/two-mathematicians-demand-answers-from-openai-on-training-data/
  7. https://en.wikipedia.org/wiki/Sofic_group
  8. https://genztech.blog/p/andreas-thom-openai-training-data-dispute/
  9. https://www.youtube.com/watch?v=WRu5nFFqZYU
  10. https://cryptobriefing.com/openai-backlash-math-discovery-astra/
AD
이 글을 얼마나 이해했나요?
Q1. 수학자 안드레아스 톰이 오픈AI에 대해 제기한 의혹은 무엇인가요?
  • 오픈AI가 자신의 연구비를 횡령했다
  • 자신의 사적인 챗GPT 대화 데이터가 모델 학습에 사용되었을 가능성
  • 자신의 논문을 표절하여 상업적으로 이용했다
안드레아스 톰은 오픈AI의 아스트라 모델이 자신의 사적인 챗GPT 대화 내용을 학습하여 비소픽 그룹 증명에 활용했을 가능성을 제기했습니다.
Q2. 비소픽 그룹(non-sofic group) 문제와 관련해 언급된 수학자는 누구인가요?
  • 앨런 튜링
  • 미하일 그로모프
  • 이세돌
비소픽 그룹의 존재 여부는 27년 전 수학자 미하일 그로모프가 처음 제기한 난제입니다.
Q3. 오픈AI는 이번 논란에 대해 어떤 입장을 보이고 있나요?
  • 데이터 사용을 인정하고 사과했다
  • 공식적인 답변을 거부했다
  • 표절 의혹을 강력히 부인했다
오픈AI는 안드레아스 톰의 의혹 제기에 대해 표절이나 도용 사실을 강력히 부인하고 있습니다.
AI가 27년 난제를 풀었다? 수학자의 의혹 제기...
0:00