(中央社旧金山17日综合外电报导)根据今天解封的一份法院文件,「纽约时报」指控OpenAI利用数百万篇新闻文章训练旗下AI模型,犯下「史无前例、规模惊人的盗窃行为」。
法新社报导,总部位于旧金山的OpenAI撷取超过1000万篇文章内容,其中有近1/3来自纽约时报(New York Times)。
文件指称,微软(Microsoft)应用科学总监赫克特(Brent Hect)曾私下称此举是「史无前例、规模惊人的盗窃行为」,甚至可能是「人类史上规模最大的劳动成果窃取案」,且OpenAI在尝试清查系统中哪些内容来自纽时及本案其他原告时,可能已构成「无意间的掩盖行为」。
微软发言人告诉法新社,该公司认为赫克特的说法仅代表「个人观点」,「不代表公司立场」。
纽时3年前已在纽约联邦法院对OpenAI与微软提告,指控他们涉嫌窃取受著作权保护的内容,用来训练OpenAI的旗舰模型ChatGPT;微软2019年起首度注资OpenAI。
除了纽时,另有多家新闻出版商陆续加入这场诉讼,他们正针对每篇据称遭到盗取并被OpenAI模型使用过的文章索赔,但求偿总金额目前仍不明朗。
参与诉讼的媒体业者包括拥有CNET等科技新闻媒体的齐夫戴维斯集团(Ziff Davis)、「琼斯夫人」(Mother Jones)杂志母公司、调查新闻网站「拦截」(The Intercept)及美国多家地方报纸。
由于原告已向法院声请提出「简易判决」,若联邦地区法官史坦(Sidney Stein)准许这项声请,本案将无须进入正式审判程序;不过,预计法院最快要到2027年才会做出裁决。
ChatGPT自2022年底推出以来,OpenAI已与全球多家新闻出版业者签署内容授权协议,但外界仍担心,生成式AI正在导致新闻网站流量下滑。
为缓解外界疑虑,AI业者曾试图在查询结果中附加来源连结,但成效不彰。根据法院文件,一名OpenAI工程师曾坦承:「无论我们把连结放得多显眼,用户都不会去点击。」
微软与OpenAI则主张,他们对新闻内容的使用具「转化性质」,属「合理使用」范畴。
#ChatGPT
#OpenAI#纽约时报#微软