杭州网 时评
近日,一起发生在美国加州的版权诉讼案,在全球引发热议。涉事企业是近几年来风头正盛的人工智能公司Anthropic。据法院公开的判决文书披露,该公司为训练其大语言模型Claude,除搜集了数百万份数字盗版书之外,还斥巨资购入数百万册纸质书,在切掉书脊、扫描书页后,该公司竟将这些书籍原件尽数销毁。更令人唏嘘的是,该公司最终被判赔偿15亿美元,但原因仅限于“持有盗版图书数据库”这一侵权行为,而其“毁书炼AI”的行为,却并未受到处罚。
书籍是人类文明的载体、人类智慧的结晶、人类进步的阶梯。人工智能通过“博览群书”汲取人类智慧,本来无可厚非。然而,用于人工智能训练的数据,理应通过合法、规范的途径取得。一些科技公司为了绕开漫长的谈判周期、规避巨额的授权成本,竟然主动让人工智能学习盗版资源,甚至为了取得竞争优势,不惜通过破坏性扫描来“加快学习进度”,暴露出一种急功近利的短视和技术至上的傲慢。
更令人担忧的是,对书籍内容进行数字化,本来无需销毁原件,该公司这种“阅后即焚”的行为,背后潜藏着危险的垄断企图。据美国《华盛顿邮报》披露,该公司于2024年初启动代号为“巴拿马计划”的项目。公司内部文件赫然写道:“巴拿马计划是指我们破坏性扫描世界上所有书籍……我们不希望外界知道我们在做这件事。”这意味着一些流散在市场中的绝版、珍本书籍,很可能在无差别的破坏性扫描中彻底消失,而这些本可以供人反复查阅、考证的书籍,将成为该公司独家占有的训练数据。这种以创新之名破坏文明载体、构建数字壁垒、垄断人类知识的行为,最终将可能导致无法估量的严重后果。
“竭泽而渔,岂不获得?而明年无鱼。”古老的东方智慧警示我们,只顾眼前利益,斩断长远根基,终将自食其果。人工智能离不开人类语料滋养,但若为了一时一己之利,便粗暴地毁掉可以反复品味、查阅和传承的书籍,不仅是对千百年来人文传统的无情亵渎,更难以预防这些内容在未来被销毁、隐匿、篡改。面对“毁书炼AI”的恶劣行径,我们不能止步于道德谴责。一方面,既要完善法律法规,妥善保护书籍、绘画、胶片等承载人类文明的实体;另一方面,更要警惕少数人以创新之名行垄断之实,鼓励建立开放、共享、可持续的数字知识库,让人类文明的灯火在数字时代照得更亮、传得更远。


