
因为未经授权拿数万首受版权保护的歌曲去训练AI,索尼音乐和华纳音乐正式把Anthropic告上了法庭。这家公司就是开发了热门AI助手Claude的独角兽企业。
唱片公司在起诉书里指控,Anthropic在训练Claude系列模型时,大量使用了受版权保护的音乐作品,既没打招呼也没付版权费。他们认为这属于科技史上规模最大、性质最恶劣的知识产权侵权之一。
更麻烦的是,Anthropic的创始人也被点名了。起诉书披露,联合创始人Benjamin Mann曾经用BitTorrent下载了超过500万本盗版图书。其他员工也没闲着,从Pirate Library Mirror这类盗版平台上又搞了200多万本电子书。
连歌词数据也是走“野路子”拿的。本来MusixMatch、LyricFind这些平台已经拿到了唱片公司的合法授权,Anthropic团队却绕过它们,直接去网上非法抓取歌词。
这次唱片公司是动了真格。他们要求法院对每一首被侵权的歌曲判赔最高15万美元;如果AI还删掉了歌曲的版权管理信息,每次再追加最高2.5万美元。法律人士算了一笔账:考虑到涉及的作品数量,如果Anthropic输掉官司并且按最高标准赔偿,总金额可能冲到几十亿美元。
这起官司把AI行业一个老问题又摆到台面上:训练数据到底能不能“拿来就用”?当越来越多的版权方选择拿起法律武器,AI公司恐怕不能只盯着模型参数做得多大,数据来源干不干净,可能会决定它们未来的生死。