
微软AI训练涉嫌版权纠纷:涉嫌盗版图书数据集训练Megatron模型
微软在训练AI模型Megatron时,被指控未经许可使用了知名作家的图书内容,引发版权诉讼。案件涉及Meta、Anthropic及OpenAI等多家科技企业,争议焦点在于AI训练过程中是否侵犯版权。
案件背景
微软正面临一宗新的版权诉讼,多位知名作家指控其在训练人工智能模型Megatron时,未经许可使用了他们的图书内容。
争议焦点
原告包括凯・伯德、贾・托连蒂诺、丹尼尔・奥克伦特等作家,指控微软利用其图书的盗版电子版训练AI,让其能够响应用户的文本指令。

法律判决
美国首个针对生成式AI是否能在未获授权的情况下使用受版权保护作品所作出的法律判决,加州一位联邦法官裁定,若使用的是盗版内容仍可能承担责任。
案件进展
微软动用了一个包含近20万本盗版书籍的数据集,用于训练其文本生成算法Megatron。作家们要求法院颁布禁令,阻止微软进一步侵权,并要求微软就每部被侵权作品支付最高15万美元的法定赔偿。