“禁止将本书用于AI训练”——图书版权页上的一行字,能拦住大模型吗?
2026-08-19   |   发布于:赛立信

2026年3月,华夏出版社出版的《新译黄庭经阴符经》版权信息页上,清晰印着一行从未见过的警示文字:“禁止将本书内容用于人工智能训练,违者必究。”这并非孤例——越来越多的新书,尤其是境外引进版,都会在版权页标注类似声明。

出版社负责人对此很坦诚:如果书籍内容在未被授权的情况下用于AI训练,“很难维权”,但出版社仍会标注,“要有态度和这样的声明,这可能会让大家意识到图书是有版权的”。


一纸声明,法律上到底算不算数?

答案是:算,但作用有限。

中国文字著作权协会常务副总干事梁飞指出,“禁止用于AI训练”的声明属于规范作品使用规则类的权利管理信息,直观体现了著作权人对自身作品使用方式的管控权利。在著作权法中,“权利人是否明示反对”会影响法院对“合理使用”抗辩的认定。

更值得注意的是,如果AI企业为规避限制,刻意抹除或删减图书上的权利标注后再纳入训练数据库,该行为已单独构成《著作权法》明令禁止的篡改权利管理信息——企业除了要承担擅自训练作品的侵权责任外,还需为删除标识的行为叠加另一重独立民事侵权责任。

然而,纸面声明终究无法自动阻拦网络爬虫。正如有评论所言,纸质书只要被人买走,扫描后提炼数据并无技术难度,版权页上的警告更像一份“君子协定”。


全球三种治理思路,差异巨大

面对AI“啃书”的版权争议,不同国家和地区的选择截然不同:

美国:合理使用唱主角,边界模糊。2025年6月,美国联邦法院在Bartz诉Anthropic案中认定,将合法购买的图书用于AI模型训练属于“合理使用”。但与此同时,法院也认定Anthropic从盗版网站下载书籍的行为构成侵权,最终该公司以15亿美元与作家达成和解。合法购买+合理使用、非法下载+侵权——一条红线划在“来源是否合法”上。

日本:宽松路线,原则上无需授权。日本《著作权法》第30条之4规定,“不以享受作品中表达的思想或情感为目的的使用”,原则上无需获得著作权人许可。AI训练恰恰属于此类“非享受性使用”。

欧盟:强制透明,让版权人“看得见”。2024年8月生效的《欧盟人工智能法案》第53(1)(d)条要求,通用人工智能模型提供者必须公开其训练数据的足够详细摘要。2025年7月,欧盟委员会发布了官方模板;2026年8月2日,相关条款正式进入执法阶段。违反者最高可被处以全球年营业额3%的罚款。

中国则走在探索路上。《生成式人工智能服务管理暂行办法》要求训练数据必须具有合法来源、不得侵犯知识产权。“十五五”规划纲要明确要建立人工智能训练数据合理使用制度。但现行法律对AI训练数据的版权问题尚未作出直接、具体的规定。


困境与出路

华夏出版社的声明之所以引发热议,恰恰因为它戳中了当前AI版权治理的核心困境:法律滞后于技术

AI训练时会把文本切碎、转换成机器专用数字代码,原本完整的原文痕迹基本消失。权利人取证溯源极为困难。与此同时,有AI公司为获取“干净语料”,批量购买二手书籍、切除书脊高速扫描后直接销毁——据报道,约200万本实体书在这一过程中被销毁。万千承载原创心血的实体典籍,沦为模型训练的一次性耗材。

有观点认为,版权保护会束缚AI技术创新。但健康的行业生态,需要原创持续造血,也需要AI合规付费取用。一纸“禁投喂”声明,既摆明了出版行业的态度,也点明了AI训练数据需要获得合理授权这一底线。

从“要有态度”到“要有制度”,中间还差一个完整的治理体系。


赛立信知识产权研究院


分享
赛立信集团总部

地址:广州市天河区体育东路116号财富广场东塔18楼

电话:020-22263200,020-22263284

传真:020-22263218

E-mail:smr@smr.com.cn



                
赛立信旗下网站
关注赛立信
免费咨询顾问一对一服务
请留下您的电话,我们的咨询顾问会在当天(工作时间)直接和您取得联系。