科思研究

驳回起诉:OpenAI暂时击败了新闻媒体关于AI训练的版权诉讼|附原文和翻译

科思律师事务所 · 2024-11-12

关注公众号并回复「媒体」

获取判决书原文和精校翻译稿

文章插图

(图片由AI生成)

去年以来,包括纽约时报、Raw Story、The Intercept和AlterNet等在内的多家机构,针对ChatGPT所属的公司OpenAI提起诉讼,指控ChatGPT非法使用了新闻网站文章用于训练。

近日,纽约联邦法官驳回了Raw Story和Alternet对OpenAI聊天机器人的训练数据提起的版权诉讼。但这两家新闻网站的律师已经明确表示,这将不会是本案的终点,他们“确信可以通过修改后的诉状,来解决法院发现的问题”。

目前,人工智能训练阶段,使用未经授权的版权作品尽心训练的问题,是人工智能诸多法律问题中最具争议性的问题之一。尽管目前OpenAI所取得的胜利也仅仅是阶段性胜利,但无论本案的走向如何,都必将深刻地影响人工智能行业的发展。

因此,我们为大家详细解读本案中值得关注的要点,欢迎大家留言讨论:

文章插图

对详细案情感兴趣的读者,可以关注公众号并在后台回复「媒体」,获取判决书原文和精校翻译稿

文章插图

案件基本信息

1.原告的诉请

(1)被告的行为违反《数字千年版权法》(Digital Millenium Copyright Act,简称DMCA)第1202(b)(1)条,原告有权获得实际或法定损害赔偿。

(2)原告请求针对被告施加禁令,要求被告删除原告作品的副本。

2.案情归纳

原告称,数千篇受版权保护的新闻作品被抓取,被告删除了这些文章的版权信息(copyright management information,简称CMI)。被告剥离了CMI后,将这些文章输入到至少三个训练集(WebText,WebText2,and Common Crawl)。这些训练集用于训练ChatGPT,ChatGPT在回复用户时不会提供作品的作者、标题和版权信息(CMI)。

原告认为,这些行为违反了《数字千年版权法》(DMCA),第1202(b)(1)条,原告有权获赔。此外,由于ChatGPT的早期版本有抄袭问题,原告担心当前版本会复制其作品,故而寻求禁令救济,要求被告移除相关作品副本。

文章插图

法院的论述

1.法律依据的查明

(1)《数字千年版权法》(DMCA)相关规定:第1202(b)(1)条规定,任何人未经版权所有者授权或法律许可,故意删除或更改版权管理信息(CMI),且明知或有合理理由知道会诱导、使能、促进或隐瞒侵权,此即双重故意要求。

(2)宪法第三条诉讼资格要求:要求原告证明遭受具体、特定、实际或迫在眉睫的损害,而损害是由被告造成,且可通过司法救济补救。在起诉阶段,原告需明确指控事实证明各要素,损害需与传统可诉损害有密切关系。

2.法院的观点

(1)应当先审查原告是否具有诉讼资格:诉讼资格是联邦案件的门槛问题,应当先进行审查。原告基于《数字千年版权法》(DMCA)起诉,根据该法的规定,原告获得诉讼资格的前提是其收到了真实的损害(而不是抽象的损害)。但法院认为,被告删除了删除了版权管理信息(CMI)的行为,不足以认为原告因此遭受了实际的损害,因此原告没有诉讼资格。

(2)原告对法律的理解错误:法院认为,《数字千年版权法》(DMCA)第1202条主要保护版权管理信息CMI的完整性,其立法历史表明,该法的目的不是防范基于财产的损害而是“通过防止欺诈和错误信息,确保电子市场的完整性”(笔者评注:有点像国内著作权法定义上的署名权);美国法典第17编第106条才涉及对作品复制和衍生作品的保护(笔者评注:有点像国内著作权法定义上的保护作品完整权)。因此,被告依据《数字千年版权法》(DMCA)第1202条请求损害赔偿的观点错误。

(3)原告不具有申请禁令救济的权利:原告认为,早期版本ChatGPT有生成抄袭内容的情况,据此推知ChatGPT未来有很大风险复制其作品的风险。因此,原告面临权益在未来被损害的风险,据此寻求法院的禁令救济。法院认为,因为ChatGPT训练数据量大,原告未证明其文章信息受版权保护,且考虑到存储库信息量,ChatGPT从原告文章中,直接输出抄袭内容可能性小,所以原告不具有寻求禁令救济的权利。

(4)法院认为原告寻求救济的方式错误:法院指出,原告真正寻求补救的,是被告使用其作品开发ChatGPT,但未对原告进行补偿对问题;而不是依据目前原告提出的法律条款,需求损害赔偿和禁令的方式。至于原告的请求是否有其他法规支持,还有待进一步探讨,但不在本次审理范围内。

文章插图

法院判决结果

法院判决驳回原告起诉

原告请求重新起诉的动议不予批准

原告重新提交一份动议,附上修正后的起诉书。

也正是因为法院允许原告方重新提交修正后的起诉书,所以才说OpenAI的胜诉是“暂时”的。

整体看下来,Raw Story和Alternet似乎在诉讼的策略上,似乎存在一定的问题。相较而言,纽约时报在诉讼中,除了主张适用《数字千年版权法》(DMCA)外,还依据1976年版权法等相关规定,围绕生成物的相似性、训练素材侵权、流量截取、模型幻觉、损害声誉等角度,论述OpenAI存在各种侵权行为。在诉讼证据的准备、诉讼请求的主张和诉讼策略的制定上,Raw Story和Alternet都存在明显的问题。

因此,作为首先做出判决的案例,本案确实具有一定的借鉴意义;但一些营销号鼓吹下定的“重磅胜利”“抓取训练数据训练AI合法化”等结论,恐怕还为时尚早。

关注公众号并回复「媒体」

获取判决书原文和精校翻译稿

---

作者简介

文章插图

陈 焕 律师

陈焕律师,《法律人ChatGPT应用指南》作者,北京市隆安(广州)律师事务所律师、隆安湾区人工智能法律研究中心主任、隆安广州数字经济部副部长、广东财经大学法学院人工智能法研究中心兼职研究员、国家工业信息安全发展研究中心《生成式人工智能数据应用合规指南》标准起草人、广州市涉外律师领军人才。

文章插图

李琪瑶 律师

李琪瑶律师,英语专业八级。现为北京市隆安(广州)律师事务所律师,隆安湾区人工智能法律研究中心研究员。李琪瑶律师擅长人工智能、数据合规、知识产权诉讼和非诉业务、民商事争议解决事务。

---

往期文章推荐:

人工智能

双十一,手可以剁,但千万不可以抖|开屏摇一摇http://mp.weixin.qq.com/s?\_\_biz=MzAxMDc0ODY5Mg==&mid=2247485819&idx=1&sn=11a356bbc01cecd1da23f85c53f06d6c&chksm=9b4adf00ac3d5616f3413de4aa0a6d60d308c0684a6a8dc086108ff9f291560118ba6b739815&scene=21#wechat_redirecthttp://mp.weixin.qq.com/s?\_\_biz=MzAxMDc0ODY5Mg==&mid=2247485819&idx=1&sn=11a356bbc01cecd1da23f85c53f06d6c&chksm=9b4adf00ac3d5616f3413de4aa0a6d60d308c0684a6a8dc086108ff9f291560118ba6b739815&scene=21#wechat_redirect

AI开始关心你的便便,挂上摄像头的马桶,要不要来一个?

爱,死亡,与AI:一个因AI而死的少年

可以控制电脑的Claude3.5,离自己上班还有多远

AI搜索还能不能行了?

拥有钢铁侠的“钞能力”:想知道这个人的名字,看眼镜就行?

Adobe:推出新应用帮助用户拒绝内容用于训练AI模型

德国法院:使用摄影作品训练AI模型不构成侵权

帮你写简历?LinkedIn是如何使用你的个人信息的http://mp.weixin.qq.com/s?\_\_biz=MzAxMDc0ODY5Mg==&mid=2247485495&idx=1&sn=d62c1ccaa230490565b41d4a183b6f78&chksm=9b4ade4cac3d575ad9554bab93813ffaef8381435712afca0b9b68451066fac2fd307d927b24&scene=21#wechat_redirect

加州通过两项法案,保护演员的肖像不被AI模仿

任天堂与宝可梦公司对《幻兽帕鲁》提起专利诉讼

《人工智能生成合成内容标识办法(征求意见稿)》公开征求意见的通知http://mp.weixin.qq.com/s?\_\_biz=MzAxMDc0ODY5Mg==&mid=2247485447&idx=1&sn=c60ec7d503c410ba89354196a4fc80f1&chksm=9b4ade7cac3d576adce5559b3e8cfeee0134a73aded5edc72b11b1b791ba31ae998564f18c8b&scene=21#wechat_redirect

中国人工智能监管及政策文件汇编

重磅:网安标委颁布《人工智能安全治理框架》1.0版

360儿童手表陷“辱华”风波,儿童智能设备如何做好合规?

利用AI换脸技术破解实名验证,太刑了

最新消息:理想已经报警。AI云诊产品有哪些合规要点?

赛博“照妖镜”:AI魑魅的标识与辨别

秘塔AI:完蛋!我们收到了知网28页的侵权告知函http://mp.weixin.qq.com/s?\_\_biz=MzAxMDc0ODY5Mg==&mid=2247485274&idx=1&sn=034cd253b62141eee8dee891f3e7031d&chksm=9b4ad121ac3d5837f35fa0dcd633afa466b0748df362437b24079a62bcdf23ef93e188d89707&scene=21#wechat_redirect

检察院发文提示人工智能合规问题 | 企业如何防控刑事风险

写给法律人/程序员:与AI“开源协议”有关的5个核心问题

最新消息:理想已经报警。AI云诊产品有哪些合规要点?

赛博“照妖镜”:AI魑魅的标识与辨别

秘塔AI:完蛋!我们收到了知网28页的侵权告知函

不用考证的赛博心理咨询师,有哪些必须做的合规要点?

大模型厂商使用用户输入信息训练AI的合规策略

律师测评 | 用户创建AI虚拟人角色,平台有哪些责任?

寡姐要告OpenAI:律师评山寨名人声音的商业模式

律师测评 | ChatGPT-4o,让人机之恋走进现实

AI生成声音第一案,给AIGC创业项目的3点教训

律师评测 | 华为手机“AI一键脱衣”

数字经济

数据资产 | 数据资源入表,到底应该如何开展工作?

最新发布:《网络数据安全管理条例》1月1日起施行

写在3季度结束前:已有41家上市公司披露数据资源入表情况

最新发布:粤港澳大湾区(内地、澳门)个人信息跨境流动标准合同实施指引

人民法院报:虚拟货币司法处置须规范化http://mp.weixin.qq.com/s?\_\_biz=MzAxMDc0ODY5Mg==&mid=2247485363&idx=1&sn=a8cf92b97ca7c8b230c4fdf81d0b1cb7&chksm=9b4ad1c8ac3d58de19d812d002cfce9db1f70f7ff70f05d4755e0daabd0b67d50fa664f84dd7&scene=21#wechat_redirect

全国首案:《数据知识产权登记证》案的几点启发

喝咖啡前,要如何“走流程”?小程序监管已来

数据资产 | 如何在农业领域发挥数据要素乘数效应

数据资产 | 公交领域数据入表案例盘点与分析

数据圆桌|数字化智能化改造最新税收优惠政策解读

醒醒吧!虚拟币征税=交易合法?

限期实缴制下出资新方式探索——数据“入表+入股”是否具有可行性?

数据资产新篇章丨隆安广州“数据资源入表实战沙龙”在南沙圆满落幕

数据资产|对企业而言,数据资源入表有6大价值

数据合规 | 家长们最在意的“青少年模式”如何做好合规?

影响数字经济领域的指导案例发布,虚拟币交易的未来何去何从?

数据产权规定汇编|国家数据局将推出8项制度文件,涉及人工智能和数据产权

观点汇编 | 数据权益的保护路径

http://mp.weixin.qq.com/s?\_\_biz=MzAxMDc0ODY5Mg==&mid=2247484863&idx=1&sn=f65eebe533851357f7857d1e747a208a&chksm=9b4ad3c4ac3d5ad2d7a91a963ea9b724ff2d644eba3ef0635084246988aa090088c8e508b855&scene=21#wechat_redirect

新书资讯

诚邀参编|全新司法解释下侵权责任编实务问答新书

通知查收|《工程老板必备法律锦囊》出书共创群

重磅推荐:《网络犯罪办案实务指南》新书上市

---

《法律人ChatGPT应用指南》,可直接点击下图购买:

文章插图