新研究证实,AI 生成书籍已挤压人类作者作品市场空间

发布于

IT之家 8 月 14 日消息,在 Anthropic 做过的诸多事情中,最容易让普通人感到震惊的,可能是处理训练书籍的方式。Anthropic 购买了数百万本二手书,切掉书脊后扫描内容,用于训练 AI 模型,完成后再把原书销毁。

很多人听到这种做法会觉得难以接受,但 Anthropic 实际上“遵循了版权法”。法律允许 **把自己拥有的书籍数字化**,只要过程中没有额外增加一份副本。在一起受到广泛关注的案件中,美国一名联邦法官也裁定,Anthropic 这一环节 **属于合理使用**。

真正长期存在争议的问题,是 AI 模型完成训练之后,**利用已经学到的内容生成新作品会造成什么影响**。

美国版权局去年研究了这一问题,并指出了 AI 公司抗辩中的最大弱点。合理使用需要考察四项因素,其中一项就是 **新作品是否会损害原作品的市场**。

美国版权局认为,利用受版权保护的作品生成商业内容,再让生成内容与原作品竞争,就会超出传统合理使用的界限。

据《商业内幕》今天(14 日)报道,过去最大的难题,是很难证明这种市场损害确实存在。而现在,研究人员已经找到了部分证据。

研究人员最近分析了 2023 年至 2026 年间在亚马逊销售的 1.4 万多本电子书,发现 **不少图书含有大量 AI 生成文本**,而且数量已经多到 **足以挤压其他图书的市场空间**。有销量的图书数量增至原来的 19 倍,读者在这些图书上的总支出只增至原来的 9 倍。

也就是说,市场变得拥挤得多,整体规模却没有以同样速度扩大,单本图书能够分到的平均收入因此减少。IT之家从报道中获悉,研究人员还发现,随着含 AI 生成文本的图书不断增加, **未检测出 AI 文本的图书市场份额也在下降**。

AI 几乎可以零成本批量生成数千本书,人类作者因此唯有与大量新增内容竞争。然而,如果没有人类作者原本的作品,这些内容也不会存在。

非营利组织 Fairly Trained CEO 埃德 · 牛顿-雷克指出,AI 公司一直声称,模型不会给那些作品被用于训练的创作者造成经济损失,可这项研究已经让那个说法“彻底站不住脚了”。

**相关阅读:**
- [研究:人们无法有效区分 AI 生成与人类原创短篇小说](https://www.ithome.com/0/987/465.htm)
- [AI 挤压作家收入:14419 本小说洞察,约 20% 书籍 AI 含量超 25%](https://www.ithome.com/0/983/976.htm)
- [AI 生成的盗版书泛滥,苹果图书和亚马逊上出现大量假冒作品](https://www.ithome.com/0/979/258.htm)

---

原文链接:[点击查看](https://www.ithome.com/0/989/951.htm)

评论

暂无评论。

0.036178s