4Sp9peYgPQ5作者:汤俏opinion.huanqiu.comarticle汤俏:对AI“猎书”喊停是时代刚需/e3pmub6h5/e3pr9baf6在最新出版的一部古籍著作的版权页上,华夏出版社罕见地加了一句声明:“禁止本书内容用于人工智能训练,违者必究。”这短短一行字,迅速引发广泛讨论。这不仅仅是一家出版社对人工智能(AI)企业的明确宣言,更代表着出版界对AI无序掠夺原创成果的一次亮剑。它也把AI时代一道版权保护难题摆到了台面上:纸质书的数据版权,究竟谁来守护?眼下,AI大模型对高质量文本的饥渴,正演变成一场对纸质书的“掠夺式开采”。相比鱼龙混杂的网络语料和数字版权受较严密保护的电子书,纸质书“质量高、限制少”,成了AI训练极佳的“优质矿场”,海量书籍、文章、文艺作品被无偿抓取投喂AI。某知名海外AI企业曾启动所谓“巴拿马计划”,斥资数百万美元批量购入二手纸质书,裁切书脊、逐页扫描,提取内容后更将实体书销毁。这种以毁书换数据的做法,被网友怒斥为“猎书”“数字焚书”。普通图书尚且大量消失,那些存世稀少的老古籍、绝版孤本一旦被卷入,便是不可逆的文化损失。更令人担忧的,是海外司法态度的暧昧。美国法院在相关诉讼中,只处罚了购买使用盗版书籍的行为,却对销毁正版实体书、无偿取用文本数据不予追究。这无异于释放信号:在现有法律框架下,AI公司可以合法消耗纸质文献,版权方却无处说理。直到最近,仍有“神秘买家”高价从全球搜集二手图书的消息,规模之大,几乎要将二手书商“逼疯”。在全球范围内,纸质书的数据版权,仍处于一片规则真空之中。 抵制AI无底线掠夺,不是拒绝技术,而是捍卫劳动价值。但现实是,AI大模型由于“黑箱”的特点,很难查证某本书是否被训练过,使用和侵权痕迹几乎无迹可寻。在采访中,出版社负责人也坦承,即便标了禁令,一旦内容被抓取,取证和维权依旧千难万难。在实践中,中小出版方也无力对抗大厂的豪华法务团,维权成本高、胜算低。此外,在版权保护与知识传播之间的平衡上,少数借机全盘否定AI技术的极端观点,也加剧了行业分歧。归根结底,这起事件本质上是全球范围内传统版权体系与AI时代脱节的一个缩影。纸质书作为实体,既缺少易用、可溯源的技术来核查使用情况,也没有行业统一的授权标准。相比保护机制相对成熟的电子书、网络文学,看起来最难被抓取的纸质书数据版权,反而成了被遗忘的角落。但即便艰难,也不能什么都不做。技术创新不能凌驾于知识产权保护之上,AI迭代不能以消耗人类原创、毁灭文化遗产为代价。如果放任AI无差别吞食原创,未来内容只会越来越同质、浅薄。当然,面对技术的发展,我们也不能因噎废食。书籍的使命是传播知识,古籍数字化也是历史有效的保存方式之一。但“共享”不等于“白拿”,技术迭代不能以践踏版权、损耗原创、毁灭文化为代价。那种“出版即开放”的论调,模糊了公共知识与私有版权的边界,忽视了创作者的基本权益——没有保护,就没有持续创作,知识共享终将是无源之水。对AI“猎书”喊停,既是一种行业态度,更是时代刚需。在主动的防御性声明外,也需要制度、技术、行业齐头并进,补齐AI训练数据版权的规则与监管体系,对书籍尤其是古籍充分保护,明确商用授权、利益共享机制和侵权责任,共建“先授权后使用”的良性生态。唯有让技术敬畏原创、规则守护版权,让AI技术在法治框架内良性发展,才能实现AI技术创新与人类文化传承的双向共赢。(作者是中国社会科学院文学研究所副研究员、网络文学研究室副主任)1786902361451环球网版权作品,未经书面授权,严禁转载或镜像,违者将被追究法律责任。责编:肖山环球时报178692058890911[]{"email":"xiaoshan@huanqiu.com","name":"肖山"}
在最新出版的一部古籍著作的版权页上,华夏出版社罕见地加了一句声明:“禁止本书内容用于人工智能训练,违者必究。”这短短一行字,迅速引发广泛讨论。这不仅仅是一家出版社对人工智能(AI)企业的明确宣言,更代表着出版界对AI无序掠夺原创成果的一次亮剑。它也把AI时代一道版权保护难题摆到了台面上:纸质书的数据版权,究竟谁来守护?眼下,AI大模型对高质量文本的饥渴,正演变成一场对纸质书的“掠夺式开采”。相比鱼龙混杂的网络语料和数字版权受较严密保护的电子书,纸质书“质量高、限制少”,成了AI训练极佳的“优质矿场”,海量书籍、文章、文艺作品被无偿抓取投喂AI。某知名海外AI企业曾启动所谓“巴拿马计划”,斥资数百万美元批量购入二手纸质书,裁切书脊、逐页扫描,提取内容后更将实体书销毁。这种以毁书换数据的做法,被网友怒斥为“猎书”“数字焚书”。普通图书尚且大量消失,那些存世稀少的老古籍、绝版孤本一旦被卷入,便是不可逆的文化损失。更令人担忧的,是海外司法态度的暧昧。美国法院在相关诉讼中,只处罚了购买使用盗版书籍的行为,却对销毁正版实体书、无偿取用文本数据不予追究。这无异于释放信号:在现有法律框架下,AI公司可以合法消耗纸质文献,版权方却无处说理。直到最近,仍有“神秘买家”高价从全球搜集二手图书的消息,规模之大,几乎要将二手书商“逼疯”。在全球范围内,纸质书的数据版权,仍处于一片规则真空之中。 抵制AI无底线掠夺,不是拒绝技术,而是捍卫劳动价值。但现实是,AI大模型由于“黑箱”的特点,很难查证某本书是否被训练过,使用和侵权痕迹几乎无迹可寻。在采访中,出版社负责人也坦承,即便标了禁令,一旦内容被抓取,取证和维权依旧千难万难。在实践中,中小出版方也无力对抗大厂的豪华法务团,维权成本高、胜算低。此外,在版权保护与知识传播之间的平衡上,少数借机全盘否定AI技术的极端观点,也加剧了行业分歧。归根结底,这起事件本质上是全球范围内传统版权体系与AI时代脱节的一个缩影。纸质书作为实体,既缺少易用、可溯源的技术来核查使用情况,也没有行业统一的授权标准。相比保护机制相对成熟的电子书、网络文学,看起来最难被抓取的纸质书数据版权,反而成了被遗忘的角落。但即便艰难,也不能什么都不做。技术创新不能凌驾于知识产权保护之上,AI迭代不能以消耗人类原创、毁灭文化遗产为代价。如果放任AI无差别吞食原创,未来内容只会越来越同质、浅薄。当然,面对技术的发展,我们也不能因噎废食。书籍的使命是传播知识,古籍数字化也是历史有效的保存方式之一。但“共享”不等于“白拿”,技术迭代不能以践踏版权、损耗原创、毁灭文化为代价。那种“出版即开放”的论调,模糊了公共知识与私有版权的边界,忽视了创作者的基本权益——没有保护,就没有持续创作,知识共享终将是无源之水。对AI“猎书”喊停,既是一种行业态度,更是时代刚需。在主动的防御性声明外,也需要制度、技术、行业齐头并进,补齐AI训练数据版权的规则与监管体系,对书籍尤其是古籍充分保护,明确商用授权、利益共享机制和侵权责任,共建“先授权后使用”的良性生态。唯有让技术敬畏原创、规则守护版权,让AI技术在法治框架内良性发展,才能实现AI技术创新与人类文化传承的双向共赢。(作者是中国社会科学院文学研究所副研究员、网络文学研究室副主任)