ChatGPT帮你“三分钟读完一本小说”,这事儿违法吗?
1、 ChatGPT的开发者OpenAI,目前面临两个诉讼。一个关于版权,一个关于隐私权。都是非常前沿棘手的问题。
2、 美国两位小说作家最近在加州南部的联邦法院,起诉了OpenAI. 他们起诉的理由很有趣,就是他们发现ChatGPT能够非常准确地概括、归纳他们小说作品的主要情节、主题和人物特点,可见,ChatGPT未经他们许可,复制、消化了他们的小说作品,这是一种侵犯版权的行为。
3、 为什么说这个问题有趣?因为假设是一个读书人,每天需要阅读大量作品(当然,他需要去正版渠道购买,或者到正规图书馆借阅),然后在豆瓣上写书评。假设,他概括的作品内容非常准确,提炼的主旨连作者都拍大腿直呼内行,只要他没有大段大段摘抄原作,他能算是侵权吗?
4、 不能。因为侵犯版权,其实是在一个比较狭窄的范围内构成的,最主要的做法就是“抄袭”或者“未经许可发布”。比如,一个张三,把李四的小说抄了个八八九九,署名是“张三”写的,这就跟偷窃没有区别;或者,张三看见李四的小说卖得好,就跟着出盗版的,也其实也算偷,等于截胡了李四本来应得的利润。但是,如果张三读完李四的作品,进行了一定程度的概括和评价,只要这种概括不会大比例搬运原作内容(换言之,看了这个所谓“概括”,等于看了三分之二本原小说,根本不用再买原作了),这都很大程度上属于版权法上的“合理使用”范畴。
5、 所以,OpenAI就是合法的喽?倒也不一定。
6、 有朋友会说,ChatGPT除了读书速度比人快,它和上面举例的书评人有什么区别呢?我觉得,这个区别恰恰就是速度。
7、 在大语言模型为基础的“生成型AI”突飞猛进的过去一年里,我始终有个不成熟的想法——规范AI的法律原理,不应该照搬人类行为的法律,因为极大的效率差异,产生了量变到质变的区别。
8、 我在之前的很多微博里一再强调,知识产权法不是一种金科玉律,它其实在不断改变身段,只为了一个目的:繁荣创作市场。
9、 为了繁荣创作市场,肯定要保护产权,不能纵容抄袭、盗版,否则会寒了创作者的心;但是,如果对创作者的保护过于宽泛,也容易让先发制人的创作者垄断市场,让后来者噤若寒蝉,远远绕着走。这就是为什么,版权法不保护“思想”、“风格”、“模式”等抽象的概念,而更多地着眼于“表达”等可以具象考察的概念。但这些都不是一成不变的,当007风靡全球的时候,以詹姆士 · 邦德为名的、以007为代号的、风流倜傥又惊险刺激的间谍人物模型,也会被变着法地保护,而不会拘泥于“思想 vs 表达”的陈规。
10、 同理。法律允许大家评论文学作品时一定程度上剧透、引用、概括原作内容大纲,是因为首先这是言论自由的应有之义,同时,这种评论虽然一定程度上会伤害作品的神秘性和对读者的完整阅读快感,但它同时也是一种对作品的宣传,更重要的是,人力所及的工作效率有天花板,对浩如烟海的作品市场,其实不会有颠覆性打击(甚至还有宣传、营销方面的优势盈余)。
11、 可是,如果一台机器,只需一个小时,就能读完几百万本书(即使都是合法购买的),并且生成极其高效、有质量的简介,更重要的是,读者如果懒得读这本书,完全可以通过跟机器对话,来获得他想了解的关于这本书的一切。换言之,很多读者发现,完全可以不用去买原作品了。在这种时候,这种行为仍然可以按照“合理使用”原则得以保护吗?我个人觉得不行,因为它相比肉身的书评人(和他或者她有限的精力,无法回答很多读者提问),这种机器不是作品的宣传工具,而是竞争者甚至替代者。
12、 OpenAI面临的另一个诉讼,其实更为典型。就是作为“生成型AI”,它可以通过被投喂数以百亿记的数据、作品、用户信息和发言,来生成非常智能的图片或者文章,可以轻易地乱真于某些作家或者画家的风格。但作为投喂的“饲料提供者”,这些海量用户、作家、画家,从来没有被分配过OpenAI由此获得的利润。这样合理吗?关于这个问题,我之前和@水木丁 等老师连麦直播探讨过,也写过一篇微博。分析的思路仍然是,机器介入后,这和一个潜心学习毕加索的少年就根本不同了。这就好像是光速状态下,应该适用相对论而不是牛顿经典力学一样。我附图在文后,大家有兴趣可以看看。
#百乐有说法#
