AIGC宇宙 AIGC宇宙

因使用受版权保护书籍训练 AI 平台,英伟达被三名作者起诉

作者:清源
2024-03-11 04:46
感谢据美国福克斯电视台北京时间今日报道,科技巨头英伟达已被三名作者起诉,因为英伟达在训练其 AI 平台 NeMo 时,未经许可使用了他们受到版权保护的书籍。三名作者 Brian Keene、Abdi Nazemian 和 Stewart O'Nan 声称,自己的作品被收录在一个包含约 196640 本书籍的数据集内,这些书籍帮助训练 NeMo 模拟普通书面语言,但这个数据集因“被举报侵犯版权”在去年 10 月被撤下。(IT之家注:该数据集原本被托管在 Hugging Face 网站上)作者们在 3 月 8 日晚提交
感谢据美国福克斯电视台北京时间今日报道,科技巨头英伟达已被三名作者起诉,因为英伟达在训练其 AI 平台 NeMo 时,未经许可使用了他们受到版权保护的书籍。

三名作者 Brian Keene、Abdi Nazemian 和 Stewart O'Nan 声称,自己的作品被收录在一个包含约 196640 本书籍的数据集内,这些书籍帮助训练 NeMo 模拟普通书面语言,但这个数据集因“被举报侵犯版权”在去年 10 月被撤下。(IT之家注:该数据集原本被托管在 Hugging Face 网站上)

作者们在 3 月 8 日晚提交给旧金山联邦法院的一份集体诉讼提案中表示,英伟达“承认”其在该数据集上训练了 NeMo,侵犯了他们的版权。

报道称,NeMo 平台的大语言模型在过去三年中,训练工作受益于这些受版权保护的作品。诉讼涉及的作品包括三名作者在 2008 年、2019 年、2007 年出版的长篇小说,包含在一个名为“The Pile”的数据中,这一数据集又包含名为“Books3”的书籍合集。

当前科技公司在训练模型时使用受版权保护内容的诉讼案与日俱增,在此之前,《纽约时报》起诉微软及其合作方 OpenAI 未经许可使用其文章训练大型语言模型,并指控其侵犯版权。

相关标签:

相关资讯

索尼音乐集团警告 AI 公司不得使用自家资产进行模型训练

感谢根据彭博社的一份新报告,索尼音乐集团正在通知各大 AI 公司不得“未经授权使用公司旗下的资产进行模型训练”。IT之家获悉,索尼音乐目前已经向 700 多家公司发送了信件,以保护其知识产权,索尼提到,任何 AI 公司未经明确许可,不得使用索尼旗下的专辑封面艺术、音乐作品和歌词等内容。在 AI 模型的训练上,版权一直是一项令人“头大”的问题,如今业界举着牌子声称“某某模型侵犯原始作者版权”的事件已经屡见不鲜,参考IT之家此前报道,今年 4 月美国众议员 Adam Schiff 提出了一项新的法案,建议 AI 公司应
5/17/2024 6:59:44 AM
漾仔

5300亿参数的「威震天-图灵」,微软、英伟达合力造出超大语 言模型

在微软和英伟达的共同努力下, Turing NLG 17B 和 Megatron-LM 模型的继承者诞生了:5300 亿参数,天生强大,它的名字叫做「Megatron-Turing」。
10/12/2021 2:42:00 PM
机器之心

英伟达被曝未经许可抓取 YouTube、Netflix 平台视频用于训练 AI

科技媒体 404Media 披露的文件显示,英伟达收集了大量受版权包含的内容,用于训练人工智能(AI)。该媒体披露的内部邮件、电子邮件、Slack 对话以及相关文件显示,英伟达从 YouTube 等多个来源收集视频素材,用于扩充训练 AI 的数据集。该媒体披露的对话显示参与该项目的员工曾提出质疑,认为擅自使用 YouTube 视频以及研究目的编译的数据集,在法律层面可能会存在问题。不过项目经理的回复是,这种收集模式已经获得了公司最高层的许可,可以使用这些内容训练 AI,并认为“完全符合版权法的文字描述和精神”。一位
8/6/2024 1:53:57 PM
故渊
  • 1