珍稀图书遭粉碎用于 AI 训练引众怒,图书数据库 ISBNdb 下架 AI 相关测试页面
发布于 · 8月2·周日 来源 · IT之家

珍稀图书遭粉碎用于 AI 训练引众怒,图书数据库 ISBNdb 下架 AI 相关测试页面

大量珍稀图书被粉碎用于大语言模型训练引发争议,图书数据库 ISBNdb 因被指牵线搭桥而下架相关测试页面并发表声明撇清关系。

关键词AIISBNdb珍稀图书遭粉碎用于训练引众怒图书数据库下架相关测试页面

近期有消息指出,部分 AI 公司为了获取高质量且规避版权风险的训练数据,大量订购并粉碎珍稀图书。这一行为引发了读书爱好者及公众的强烈不满,暴露出大模型训练数据获取过程中的伦理与法律灰色地带。

图书数据库网站 ISBNdb 成为此次争议的焦点,外界认为该平台不仅鼓励此类做法,还充当了 AI 公司与图书供应商之间的中介角色。面对舆论压力,ISBNdb 迅速下架了相关测试页面,并发布声明试图与粉碎图书的行为划清界限。

该事件反映出当前大语言模型对高质量语料库的迫切需求,以及现有版权保护机制在面对 AI 训练数据抓取时的滞后性。随着模型参数规模不断扩大,数据质量成为关键瓶颈,但也带来了更复杂的合规挑战。

此次风波可能促使 AI 行业重新审视数据采购流程,加强版权合规审查。未来,如何在保障训练数据质量的同时尊重知识产权,将成为大模型厂商必须面对的重要课题。

本站展示内容为基于公开信息的资讯解读与整理,不代表原文转载。如需核实细节或获取完整报道,请通过下方链接访问原始来源。