OpenAI在2019年开发的语言模型GPT-2,因其生成的文章过于令人信服,出于对被滥用的担忧,曾一度推迟了完整模型的发布。
想象一下。某天早上,你对人工智能说:“请根据昨天发生的事情写一篇令人信服的新闻报道”,结果它瞬间就写出了一篇比人类写得还要像样的文章。这对今天的我们来说是很熟悉的景象,但在2019年,这种能力同时带来了惊叹与恐惧。这就是AI历史上非常重要的一个事件——OpenAI的“GPT-2”登场时的故事。
为什么这很重要?
| 2019年,非营利性人工智能研究企业OpenAI发布的语言模型GPT-2震惊了全球技术界。因为它不仅能写出语法正确的文章,更能生成极其精巧且令人信服的文本。当时,OpenAI严重担心这项技术会被用于大规模生成假新闻,或被用于欺骗人类的恶意目的[来源: OpenAI built a text generator so good, it’s considered too dangerous | TechCrunch](https://techcrunch.com/2019/02/17/openai-text-generator-dangerous/)。 |
这是一起不同寻常的事件,开发技术的企业主动表示“我们的技术太优秀了,可能会有危险”,并拒绝了完整发布。从企业开始主动思考技术对社会产生的负面影响这一角度来看,这成为了当今我们所讨论的“AI安全性”议题的重要转折点来源: OpenAI built a text generator so good, it’s considered too dangerous - Know the Technology News。
浅显易懂:预测下一个词的达人
那么,GPT-2到底是怎么写出那样文章的呢?简单来说,GPT-2是“预测下一个词游戏”的达人。
打个比方。还记得小时候和朋友玩“接龙”吗?GPT-2通过阅读世界上所有的书籍和互联网文章,学习了某个词后面跟什么词的概率更高。通过学习约40GB的庞大文本数据,GPT-2掌握了把握上下文、挑选下一个最自然词汇的能力,这种能力得到了飞跃性的提升来源: Meet OpenAI’s Text Generator That’s Considered Too Dangerous To Release - AfroTech。
这就好比有一位非常能干的秘书,他读了数万本书,只要你给出一句开头,他就能完美地写出后续的内容。人们因为这种“预测下一个词的能力”过于精巧,以至于感觉AI仿佛像人一样自己在思考、在写文章。
当前情况
| 当时OpenAI的研究人员表示:“出于对恶意使用的担忧,决定不公开训练好的完整模型”来源: Meet OpenAI’s Text Generator That’s Considered Too Dangerous To Release - AfroTech。他们打破惯例,决定隐藏全部训练代码和数据[来源: New AI fake text generator may be too dangerous to release, say creators | AI (artificial intelligence) | The Guardian](https://www.theguardian.com/technology/2019/feb/14/elon-musk-backed-ai-writes-convincing-news-fiction)。 |
作为代替,OpenAI选择了发布规模远小于原模型的版本来源: OpenAI says its text-generating algorithm GPT-2 is too dangerous to release.。这一决定成为了点燃社会对AI技术发展的潜在威胁以及如何安全处理该技术进行深入讨论的契机。
未来会怎样?
2019年的事件仅仅是个开始。当时的担忧在今天变成了更现实的课题。验证人工智能生成的文章在多大程度上符合事实(factuality),并制定防范利用AI进行恶意企图的技术和社会性机制,依然是重要的任务来源: Why OpenAI’s fake news warnings are a bit overblown - TechTalks。现在,技术发展的核心已经不再是“制作出高性能的AI”,而是“如何安全地使用它”。
MindTickleBytes的AI记者观点
GPT-2给世界带来的冲击不仅仅是对技术的炫耀。这是一个企业自主承认技术拥有改变社会的力量,并暂时停下脚步的记录。我们要记住,我们今天享受的便捷AI服务,是建立在当年那种谨慎思考的基础上的。
参考资料
-
[OpenAI built a text generator so good, it’s considered too dangerous TechCrunch](https://techcrunch.com/2019/02/17/openai-text-generator-dangerous/) -
[New AI fake text generator may be too dangerous to release, say creators AI (artificial intelligence) The Guardian](https://www.theguardian.com/technology/2019/feb/14/elon-musk-backed-ai-writes-convincing-news-fiction) - OpenAI says its text-generating algorithm GPT-2 is too dangerous to release.
- OpenAI built a text generator so good, it’s considered too dangerous to release - Know the Technology News
-
[The AI Text Generator That’s Too Dangerous to Make Public WIRED](https://www.wired.com/story/ai-text-generator-too-dangerous-to-make-public/) - Meet OpenAI’s Text Generator That’s Considered Too Dangerous To Release - AfroTech
- Why OpenAI’s fake news warnings are a bit overblown - TechTalks
- 技术故障太多
- 担心被滥用以及自动生成假新闻
- 开发成本太高
- 分析图像并将其转换为文本的方式
- 通过学习文本样本来预测下一个单词的方式
- 与人类实时对话并进行学习的方式
- 完整公开了数据集和代码
- 只公开了部分信息,并保留了完整模型的发布
- 不对公众公开,仅向研究机构销售