找回密码
 立即注册
查看: 407|回复: 0

汤俏:对AI“猎书”喊停是时代刚需

[复制链接]

119

主题

51

回帖

536

积分

高级会员

积分
536
发表于 2026-8-22 15:46:56 | 显示全部楼层 |阅读模式
在最新出版的一部古籍著作的版权页上,华夏出版社罕见地加了一句声明:“禁止本书内容用于人工智能训练,违者必究。”这短短一行字,迅速引发广泛讨论。这不仅仅是一家出版社对人工智能(AI)企业的明确宣言,更代表着出版界对AI无序掠夺原创成果的一次亮剑。它也把AI时代一道版权保护难题摆到了台面上:纸质书的数据版权,究竟谁来守护?) u5 v+ U6 M3 o6 M" ^! v- c$ v+ w
眼下,AI大模型对高质量文本的饥渴,正演变成一场对纸质书的“掠夺式开采”。相比鱼龙混杂的网络语料和数字版权受较严密保护的电子书,纸质书“质量高、限制少”,成了AI训练极佳的“优质矿场”,海量书籍、文章、文艺作品被无偿抓取投喂AI。某知名海外AI企业曾启动所谓“巴拿马计划”,斥资数百万美元批量购入二手纸质书,裁切书脊、逐页扫描,提取内容后更将实体书销毁。这种以毁书换数据的做法,被网友怒斥为“猎书”“数字焚书”。普通图书尚且大量消失,那些存世稀少的老古籍、绝版孤本一旦被卷入,便是不可逆的文化损失。
9 z. R. w. S3 i+ E: |. E更令人担忧的,是海外司法态度的暧昧。美国法院在相关诉讼中,只处罚了购买使用盗版书籍的行为,却对销毁正版实体书、无偿取用文本数据不予追究。这无异于释放信号:在现有法律框架下,AI公司可以合法消耗纸质文献,版权方却无处说理。直到最近,仍有“神秘买家”高价从全球搜集二手图书的消息,规模之大,几乎要将二手书商“逼疯”。在全球范围内,纸质书的数据版权,仍处于一片规则真空之中。& u, X" {# f1 J; n6 v+ T1 L
                          抵制AI无底线掠夺,不是拒绝技术,而是捍卫劳动价值。但现实是,AI大模型由于“黑箱”的特点,很难查证某本书是否被训练过,使用和侵权痕迹几乎无迹可寻。在采访中,出版社负责人也坦承,即便标了禁令,一旦内容被抓取,取证和维权依旧千难万难。在实践中,中小出版方也无力对抗大厂的豪华法务团,维权成本高、胜算低。此外,在版权保护与知识传播之间的平衡上,少数借机全盘否定AI技术的极端观点,也加剧了行业分歧。
4 r# }5 y8 h9 p" |! p归根结底,这起事件本质上是全球范围内传统版权体系与AI时代脱节的一个缩影。纸质书作为实体,既缺少易用、可溯源的技术来核查使用情况,也没有行业统一的授权标准。相比保护机制相对成熟的电子书、网络文学,看起来最难被抓取的纸质书数据版权,反而成了被遗忘的角落。
8 _' C2 c0 {( e) p3 L: _但即便艰难,也不能什么都不做。技术创新不能凌驾于知识产权保护之上,AI迭代不能以消耗人类原创、毁灭文化遗产为代价。如果放任AI无差别吞食原创,未来内容只会越来越同质、浅薄。
8 B2 t7 M' W; I* y7 D6 R当然,面对技术的发展,我们也不能因噎废食。书籍的使命是传播知识,古籍数字化也是历史有效的保存方式之一。但“共享”不等于“白拿”,技术迭代不能以践踏版权、损耗原创、毁灭文化为代价。那种“出版即开放”的论调,模糊了公共知识与私有版权的边界,忽视了创作者的基本权益——没有保护,就没有持续创作,知识共享终将是无源之水。! |9 I3 B4 g4 L% d% k
对AI“猎书”喊停,既是一种行业态度,更是时代刚需。在主动的防御性声明外,也需要制度、技术、行业齐头并进,补齐AI训练数据版权的规则与监管体系,对书籍尤其是古籍充分保护,明确商用授权、利益共享机制和侵权责任,共建“先授权后使用”的良性生态。唯有让技术敬畏原创、规则守护版权,让AI技术在法治框架内良性发展,才能实现AI技术创新与人类文化传承的双向共赢。(作者是中国社会科学院文学研究所副研究员、网络文学研究室副主任)
集群智慧云科服专利申请服务
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则


快速回复 返回顶部 返回列表