claude说中国蒸馏他们的模型,如果模型蒸馏就被定义为"偷盗"的话,那么这个地球上所有的大模型都会陷入同样的争议中。
为什么呢?
因为几乎所有的模型,训练时,它们都是从互联网上海量的、人类创作的内容中学习,包括新闻、书籍、论坛、视频等等。
当所有模型都建立在大家曾经的公开知识之上时,一个建立在公共知识上的模型,连自己的模型都是建立在未经许可获取的知识之上的,你怎能对自己偷盗来的知识赋予版权?
所以在大模型行业,有一个问题值得深思,蒸馏是不是盗窃暂且不论,当人类所有知识和能力都能被无限复制时,AI公司的护城河究竟还剩下什么呢?
大家认为呢,评论区说说!
发布于 云南
