AI太聪明了而拒绝公开?2019年“GPT-2”令人震惊的出道

一张合成图形,包含了OpenAI的旧标志和2019年当时关于AI技术的新闻头条
AI Summary

OpenAI在2019年开发的语言模型GPT-2,因其生成的文章过于令人信服,出于对被滥用的担忧,曾一度推迟了完整模型的发布。

想象一下。某天早上,你对人工智能说:“请根据昨天发生的事情写一篇令人信服的新闻报道”,结果它瞬间就写出了一篇比人类写得还要像样的文章。这对今天的我们来说是很熟悉的景象,但在2019年,这种能力同时带来了惊叹与恐惧。这就是AI历史上非常重要的一个事件——OpenAI的“GPT-2”登场时的故事。

为什么这很重要?

2019年,非营利性人工智能研究企业OpenAI发布的语言模型GPT-2震惊了全球技术界。因为它不仅能写出语法正确的文章,更能生成极其精巧且令人信服的文本。当时,OpenAI严重担心这项技术会被用于大规模生成假新闻,或被用于欺骗人类的恶意目的[来源: OpenAI built a text generator so good, it’s considered too dangerous TechCrunch](https://techcrunch.com/2019/02/17/openai-text-generator-dangerous/)。

这是一起不同寻常的事件,开发技术的企业主动表示“我们的技术太优秀了,可能会有危险”,并拒绝了完整发布。从企业开始主动思考技术对社会产生的负面影响这一角度来看,这成为了当今我们所讨论的“AI安全性”议题的重要转折点来源: OpenAI built a text generator so good, it’s considered too dangerous - Know the Technology News

浅显易懂:预测下一个词的达人

那么,GPT-2到底是怎么写出那样文章的呢?简单来说,GPT-2是“预测下一个词游戏”的达人。

打个比方。还记得小时候和朋友玩“接龙”吗?GPT-2通过阅读世界上所有的书籍和互联网文章,学习了某个词后面跟什么词的概率更高。通过学习约40GB的庞大文本数据,GPT-2掌握了把握上下文、挑选下一个最自然词汇的能力,这种能力得到了飞跃性的提升来源: Meet OpenAI’s Text Generator That’s Considered Too Dangerous To Release - AfroTech

这就好比有一位非常能干的秘书,他读了数万本书,只要你给出一句开头,他就能完美地写出后续的内容。人们因为这种“预测下一个词的能力”过于精巧,以至于感觉AI仿佛像人一样自己在思考、在写文章。

当前情况

当时OpenAI的研究人员表示:“出于对恶意使用的担忧,决定不公开训练好的完整模型”来源: Meet OpenAI’s Text Generator That’s Considered Too Dangerous To Release - AfroTech。他们打破惯例,决定隐藏全部训练代码和数据[来源: New AI fake text generator may be too dangerous to release, say creators AI (artificial intelligence) The Guardian](https://www.theguardian.com/technology/2019/feb/14/elon-musk-backed-ai-writes-convincing-news-fiction)。

作为代替,OpenAI选择了发布规模远小于原模型的版本来源: OpenAI says its text-generating algorithm GPT-2 is too dangerous to release.。这一决定成为了点燃社会对AI技术发展的潜在威胁以及如何安全处理该技术进行深入讨论的契机。

未来会怎样?

2019年的事件仅仅是个开始。当时的担忧在今天变成了更现实的课题。验证人工智能生成的文章在多大程度上符合事实(factuality),并制定防范利用AI进行恶意企图的技术和社会性机制,依然是重要的任务来源: Why OpenAI’s fake news warnings are a bit overblown - TechTalks。现在,技术发展的核心已经不再是“制作出高性能的AI”,而是“如何安全地使用它”。


MindTickleBytes的AI记者观点

GPT-2给世界带来的冲击不仅仅是对技术的炫耀。这是一个企业自主承认技术拥有改变社会的力量,并暂时停下脚步的记录。我们要记住,我们今天享受的便捷AI服务,是建立在当年那种谨慎思考的基础上的。

参考资料

  1. [OpenAI built a text generator so good, it’s considered too dangerous TechCrunch](https://techcrunch.com/2019/02/17/openai-text-generator-dangerous/)
  2. [New AI fake text generator may be too dangerous to release, say creators AI (artificial intelligence) The Guardian](https://www.theguardian.com/technology/2019/feb/14/elon-musk-backed-ai-writes-convincing-news-fiction)
  3. OpenAI says its text-generating algorithm GPT-2 is too dangerous to release.
  4. OpenAI built a text generator so good, it’s considered too dangerous to release - Know the Technology News
  5. [The AI Text Generator That’s Too Dangerous to Make Public WIRED](https://www.wired.com/story/ai-text-generator-too-dangerous-to-make-public/)
  6. Meet OpenAI’s Text Generator That’s Considered Too Dangerous To Release - AfroTech
  7. Why OpenAI’s fake news warnings are a bit overblown - TechTalks
AD
测试你的理解
Q1. 2019年OpenAI迟迟不愿公开GPT-2完整模型的主要原因是什么?
  • 技术故障太多
  • 担心被滥用以及自动生成假新闻
  • 开发成本太高
OpenAI认为GPT-2编写文章过于精巧,有被用于恶意目的或自动生成假新闻的风险。
Q2. GPT-2的设计运作方式是什么?
  • 分析图像并将其转换为文本的方式
  • 通过学习文本样本来预测下一个单词的方式
  • 与人类实时对话并进行学习的方式
GPT-2的设计基于40GB的文本数据,旨在预测下一个即将出现的单词。
Q3. 当时OpenAI是如何发布GPT-2的?
  • 完整公开了数据集和代码
  • 只公开了部分信息,并保留了完整模型的发布
  • 不对公众公开,仅向研究机构销售
出于对滥用可能性的担忧,OpenAI没有发布完整模型和训练代码,而是发布了一个规模小得多的版本。