出版社标注禁用于ai训练,一纸声明能拦住大模型吗?
一、事件经过:从“一句标注”到全网热议
发现与关注:2026年8月初,网友在《新译黄庭经 阴符经》等书的版权信息页发现“禁止将本书内容用于人工智能训练,违者必究”字样,迅速引发社交媒体讨论。该书由华夏出版社出版发行,著作财产权人为三民书局股份有限公司。
出版社回应:华夏出版社相关负责人向媒体表示,在引进某些书籍时,权利方会在合同中添加相关条款,禁止把该书内容用于AI训练,“作为履约方,我们要对权利方有交代,所以会写上这句话”。该社目前很多非引进书籍也已标注同一声明。
背后动因:这一标注并非孤立事件。此前,AI公司Anthropic被曝采用“破坏性扫描”方式——直接切掉书脊高速扫描后销毁纸质书,导致约200万本实体书被毁。此举虽在部分司法裁决中被认定为“合理使用”,但彻底刺痛了出版业的神经。
二、法律与现实困境:一纸声明能拦住AI吗?
维权难度极高:华夏出版社负责人坦言,AI技术迭代迅速,“投喂给它的东西和它‘吐’出来的东西可能完全不一样”,在此情况下很难维权。多位网友也质疑:“假如拿去训练,版权方能发现吗?”
法律性质清晰:依据《著作权法》,书籍文本属于作者享有著作权的作品,未经许可批量抓取并用于模型训练属于侵权行为。但当前国内法律尚未对“文本数据挖掘用于AI训练”是否属于“合理使用”作出明确界定,单方面声明的强制约束力有限。
声明的重要价值:多位法律人士指出,该声明虽无法直接阻止数据抓取,却清晰保留了权利人明确拒绝授权的证据,未来若发生诉讼,可有力削弱对方“合理使用”的抗辩空间。正如行业观察者所言:“这份印在版权页上的声明,可能是将来版权法修订时最好使的注脚”。

三、行业趋势:从“被动防御”到“主动建章”
出版业集体行动:除华夏出版社外,越来越多出版社已关注到书籍被用于AI训练的现象,并在内部讨论后决定标注此类声明。业内分析指出,随着AI技术对内容产业渗透加深,此类版权标注或将变成行业标配。
全球版权博弈升温:2024年起,大批作家、插画师、音乐人集体起诉Anthropic、Google等头部AI企业,指控其利用盗版资源训练模型。2026年相关案件迎来关键结果,涉案AI企业达成15亿美元巨额和解,创下美国AI版权诉讼最高纪录。
建立合理机制的共识:高质量语料库正在成为稀缺资源。业内专家呼吁建立“版权许可+收益分成”机制,既保护创作者积极性,又为AI发展提供合法“燃料”。出版社与创作者越来越意识到:单纯“禁止”不够,需要从立法、技术、授权等多层面构建可持续的共生秩序。