字号 ·· | 护眼
Mother Jones

我们正在起诉ChatGPT——而特朗普刚刚介入。

前几天,我问ChatGPT一个我永远不会忘记的政治时刻:“47%的故事讲的是什么?”它回答得基本准确。但有一个明显的遗漏——完全没有提到那个揭露了改变那次选举周期的事件报道。摘要中没有我们报道的链接或引用。你会以为这一切都是AI凭空想出来的,呃,从它脑袋里冒出来的。

我问了一些后续问题,ChatGPT又吐出了更多关于这个故事的细节,包括视频中的长篇引述。整个过程大概只花了20秒。

相比之下,我们的华盛顿分社社长戴维·科恩花了几个月才拿到独家新闻。他深入挖掘这位候选人在对冲基金领域的背景,追踪到罗姆尼曾吹嘘自己投资将美国工作岗位转移到海外的演讲。最终,这让他找到了那段秘密视频,随后戴维和编辑部的一个团队花了数周时间核实内容,补充背景报道,并想办法在保护消息来源的同时将其公之于众。

当然,OpenAI并没有做任何报道来生成它的摘要。他们只是把报道的文本大量抓取,用来训练ChatGPT像人类一样说话。我们知道这一点,因为在早期版本中,OpenAI列出了其数据来源(此后他们对此闭口不谈),而在那些数据集中,我们找到了成千上万篇我们的报道。

OpenAI从未请求允许使用我们的作品,也没有提出支付许可费。无论是当时他们正在建立自己的业务,还是现在他们正准备进行可能高达1万亿美元的首次公开募股,都没有。而且,据我们所知,OpenAI也没有向无数其他出版商、作家、创作者或网络发帖者(可能包括你)请求许可或获取授权,而他们的知识产权被OpenAI吞噬了。

并不是说这家世界上最有价值的公司之一付不起钱。他们有钱租办公室、付电费、提供免费午餐、支付高得离谱的薪酬、建数据中心,以及许多其他东西。为什么不为内容付费呢?

OpenAI声称,根据一个叫做“合理使用”的法律概念,他们可以免费使用这些内容,因为他们将其转化为新的东西,就像音乐家采样一段音轨来创作新作品一样。但不同于艺术家致敬前辈,OpenAI“转化”信息的方式是让任何人都不知道信息来自哪里,他们在处理信息时剥离了版权和作者信息。这就像偷了你的车,然后磨掉车辆识别码(只不过涉及数百万或数十亿辆车)。

也许OpenAI认为出版商,尤其是像我们这样的非营利组织,无法进行抗争。毕竟,我们的预算大约是萨姆·奥尔特曼净资产的0.5%,而他们的法律团队——这么说吧,在旧金山或华盛顿,你扔一个高尔夫球都能砸到他们的人。

而且OpenAI有唐纳德·特朗普站在他们一边。本周,政府不嫌麻烦地在诉讼中提交了一份简报,这是政府在案件这么早期阶段采取的罕见举措。这份简报支持OpenAI,称AI公司不必为内容付费是至关重要的国家利益(还挖苦说,付费只会是对“老牌主流媒体公司”的补贴)。考虑到特朗普在付钱给他人方面的历史,这倒是一脉相承。

但OpenAI——以及特朗普——都错了。正如并非所有社区都在数据中心面前屈服(尽管特朗普命令他们“让数据为王”),一些出版商正在反击,我们就是其中之一。过去两年,我们一直在参与一场诉讼,要求OpenAI尊重我们的版权,而9月4日是一个关键的最后期限,双方都要求法院在审判前就本案作出裁决。所以现在似乎是时候来剖析一下正在发生的事情了,因为这关乎的远不止新闻业。

作为一个社会,我们开始面对这样一个事实:科技大亨们正在建造他们自己都不理解、也无法控制的东西。就像人类第一次分裂原子时一样,我们正在应对一种既可以极其有用又极其危险的技术,而目前看来,从企业CEO到政客,我们的领导人似乎都不愿意应对这些风险。正如马特奥·王和查理·沃泽尔在《大西洋月刊》上所写,“感觉就像没有任何个人、组织或政府真正在引导这项技术的发展,也没有人对其负责。”(强调是我加的。)看着这一切发生如此令人沮丧的一个原因是,虽然技术是新的,但剧本却异常熟悉。从Uber和Airbnb推出产品时碾压社区,到Flock把我们所有人置于监控之下,我们已经看过这部电影了:科技公司为所欲为,拿走它需要的东西,然后才请求许可。或者永远不请求,因为“快速行动,打破常规”。新闻业也是如此。当年Facebook和谷歌试图通过提供新闻来吸引用户时,他们偶尔会给出版商开支票——付钱让他们转向视频、出现在推广的“新闻标签”中,或参与事实核查项目。不可避免地,他们会挑选大型商业出版商作为合作伙伴,进一步集中信息生态系统。(当然,最后被开玩笑的是出版商,当科技巨头撤回新闻并敞开大门让虚假信息涌入时。)而现在AI公司正在玩同样的游戏。OpenAI已经挑选了一些媒体公司达成协议,包括《大西洋月刊》、《纽约时报》、Vox Media、德国出版巨头阿克塞尔·斯普林格、鲁珀特·默多克的新闻集团等。官方的说法是,用《大西洋月刊》首席执行官尼克·汤普森的话说,这些协议将给新闻业“一个在塑造新闻如何在其平台上呈现方面的发言权”。但在欢呼背后隐藏着恐慌。

我们正在走向一个世界——也许我们已经身处其中——大多数人从聊天机器人那里获取新闻。当然,有些人可能会继续在网站上阅读文章,就像我们偶尔还会在电影院看电影一样。但那不会是大多数时候观众与新闻连接的方式,这意味着今天许多为新闻业提供资金收入的来源——广告、订阅、捐赠——将会消失。

面对一个巨大的机器人即将扼杀这个行业,乞求施舍可能是一个有吸引力的短期策略。但这不是我们《琼斯母亲》和调查报道中心的风格。我们已经对抗过黑钱亿万富翁和隐秘的慈善机构、里根政府的国税局和特朗普五角大楼的走狗。所以我们也正在对抗这个巨人。

这并不容易。我们的团队花了无数时间为此案挖掘信息、整理动议、进行证词陈述。但这是值得的,因为这是关键的一战——为了我们,也为了你。

AI模型不会事实核查、验证或调查。它们不会仔细研究文件、提交《信息自由法》请求,也不会和某人坐在一起几个小时直到他们准备好讲述自己的故事。它们不会在晚上睡觉时想着如何首次将一个故事公之于众。

在过去的40年里,新闻业经历了许多危机,我们失去了很多。数万个工作岗位消失了,全国三分之二的报纸已经关闭。但如果AI公司切断了记者和我们所服务的人之间的联系——如果一个聊天机器人给你信息,而你不知道是谁努力挖掘出来的——那真的就游戏结束了。

AI公司有很多钱和时间。新闻编辑室没有。但我们正在为生存而战,为你需要知道的真相而战。这是我们所有人的战斗。