Archive Vol · VOL-0086 · AI 协同实验室

《纽约时报》和OpenAI侵权案启示:个体内容创作者的权利到底要不要尊重和保护?

2023年12月30日 6 min read 18 次阅读 原始公众号链接

版权对于创作者来说是放大个人影响力的杠杆。

阅读 18

阡远炳木 2023年12月30日 17:54

专注深耕传媒行业,擅长个人成长、知识管理、职场干货、广告公关、市场营销、互联网领域价值观点内容输出,感谢关注!

近日,互联网媒体和科技频道的热门话题集中在《纽约时报》对微软和OpenAI提起的侵权诉讼上。不仅在法律界,也在科技和媒体行业内引发了激烈的讨论。各方观点纷呈,从法律专家到科技评论员,再到普通网民,都在尝试解读这一事件的意义和可能的后果。在对这件事的了解过程中,也启发了一些我个人的思考。

**
一、事件原委**

《纽约时报》作为西方传统媒体中影响力最大的机构之一,与代表AI技术「最先进生产力」的OpenAI正式开撕。 诉讼称,这些人工智能产品接受了数百万条《纽约时报》内容的训练,并利用这些材料为用户提供答案, 从而分流了原本会流向《纽约时报》的网络流量,影响了该公司的广告、许可和订阅收入。

Image

《纽约时报》要求对这起诉讼进行陪审团审判,并要求法院阻止科技公司继续使用其内容、销毁包含《纽约时报》内容的数据集,以及寻求损害赔偿。

报道称,开发人工智能产品的科技公司普遍认为,根据相关法律条款,开放互联网上可使用的内容可以用于培训人工智能产品。美国版权局表示,它发起了一项倡议来研究人工智能所引发的一系列问题。

‘ fill=’%23FFFFFF’%3E%3Crect x=’249′ y=’126′ width=’1’ height=’1’%3E%3C/rect%3E%3C/g%3E%3C/g%3E%3C/svg%3E)

此外,有多名美国作家对美国“开放人工智能研究中心”(OpenAI)和微软公司提起诉讼。这些作家向法庭表示,两家公司在未经许可的情况下,从互联网上批量复制了他们的作品,将这些作品用于训练和开发聊天机器人等人工智能产品,应承担侵权责任。 作家们向法院提出了金额不详的赔偿要求,并要求法院下令这些公司停止侵犯版权。

当前,AI正处于一个快速发展的阶段,与此同时,法律对于AI使用内容资产进行训练的行为还没有一个明确的界定。这种不确定性在版权法的应用上尤为明显,因为AI与内容资产的关系存在着复杂的互动。

一方面,可以认为AI侵犯了内容资产的权益,因为它需要学习现有的数据来进行训练。这些数据往往是由内容创作者精心制作的,拥有相应的版权保护。 然而,AI生成的输出内容是通过其算法自行加工和创造的,这使得它与原始数据存在一定的区别。

另一方面,也有观点认为AI并没有直接侵犯内容资产的权益。 AI的工作依赖于对大量数据的分析和学习,但它生成的内容是基于这些数据的新创作。这种情况下,AI并不是在复制或直接分发原始内容,而是在创造新的内容。

‘ fill=’%23FFFFFF’%3E%3Crect x=’249′ y=’126′ width=’1’ height=’1’%3E%3C/rect%3E%3C/g%3E%3C/g%3E%3C/svg%3E) (Chat GPT 首页备注)

此外,还存在一些问题是AI在引用内容资产后可能产生的误导或错误信息。在这种情况下,确定责任归属变得异常复杂。

**
二、这件事带来的启发和思考**

1、版权对于创作者来说是放大个人影响力的杠杆

对于从事创意产业(如写作、音乐、艺术设计、影视制作等)的人来说,创作自己的版权作品是非常重要的,这不仅能展示自己的技能和创造力,还直接影响实实在在的收入。而且,拥有自己的版权作品意味着可以控制这些作品的使用和分发,这在让作品商业化保护作品不被未经授权的使用时非常重要。

此外,之前我也反复强调过, 打造属于自己的「知识产权」杠杆,不仅能够极大程度放大个人影响力,而且还是形成复利个人实现财富增长的重要途径,这个过程极其艰难但十分必要。

很显然, 我们无法靠出卖时间变富,而是需要资产或被动收入,而个人知识产权就是一种更非常稀缺和重要的资产。为此,我们需要日复一日的调动自己的劳动力、精力、智力甚至是资金投入来打造这个「杠杆」,创造边际成本为零的知识版权产品。

‘ fill=’%23FFFFFF’%3E%3Crect x=’249′ y=’126′ width=’1’ height=’1’%3E%3C/rect%3E%3C/g%3E%3C/g%3E%3C/svg%3E) (Midjourney Bot 生成作品)

**
2、互联网世界里的版权护城河**

除了这些头部的媒体机构,AI 公司自己相互之间也是严防死守,不让对方利用自己的技术和数据,毋庸置疑这是构筑竞争优势的必要手段,商业世界的规则就是这样的。

比如ChatGPT它的网页搜索功能使用的是 Bing 而不是 Google,众所周知 ChatGPT 的股东是微软。如果它要使用 Google 的数据,Google 说不定会开出一个巨额许可价,毕竟 Google 自己也有 AI Bard,不可能把最优质的数据给OpenAI。国内各个互联网大厂何尝不是如此。

比如,有网友说,我们把微信公众号的文章发给腾讯的混元就总结得很好,而百度的文心一言估计这辈子都别想得到微信公众号里的内容了,更不要说总结了。

之前使用字节旗下的AI机器人产品「豆包」,体验非常好,感觉是国内一众大模型中表现最好的了(仅个人体验)。经了解,据媒体报道,字节跳动一直秘密使用 OpenAI 的技术开发自家大语言模型,违反了 OpenAI 的服务条款被 OpenAI 暂停账户。字节跳动对此回应「小规模应用于实验性项目,4 月已停止」。

事实上,这在很大程度上反映了过去 20 年互联网发展的一个显而易见的结果,我们生活在一个寡头垄断,并彼此互不承认的赛博世界里。

**在所有数据的争夺之中,倒是有一类数据几乎可以畅通无阻地获得,那就是个人用户的隐私数据。

**

三、个人对这件事的观点

起初,在反复深入思考这件事的时候,我陷入了一种相对矛盾的状态之中了。首先,我是一个写作者、创作者, 我希望自己的观点文章和作品受法律的保护,而不是不经过同意,未来或许现在已经在未经授权的情况下被抓取去训练AI语言大模型了。

但是, 我又希望这些大模型能够再智能一点,因为在这些强大工具的辅助下,我们个体或许可以创造出更加丰富和未知的事物,这件事光是想想就非常激动人心。 但是让大模型更智能的前提是,全世界更多的数据当然也包括个人的数据尽可能多的都用来训练大模型。

尽管当前的科技发展和法律环境仍在不断演变, 我希望在未来创作者的权利应当得到充分的尊重和保护。希望在科技进步的同时,法律体系也应逐步完善,以确保我们这些个人创作者不仅能够保护自己的劳动成果,还能从AI技术的发展和新兴的收入模式中获益。

最终,无论是媒体巨头、互联网大公司、前沿科技的开拓者,还是像我们这样的小规模内容创作者,都应该寻求更多的互惠互利的合作方式。通过不断地探讨、思考和实践,我们可以共同寻找到既促进技术创新,又保护创作者权益的解决方案。

作者提示: 个人观点,仅供参考

GROWTH LAYER

生长批注

0 条

选中正文,在右侧留下批注。

还没有批注。

DISCUSSION

文章评论

0 条

批注针对原文,评论讨论整篇文章。所有评论都会直接发布。

    还没有评论,欢迎留下第一个想法。