微软员工质疑AI数据抓取是否堪称“人类历史上最大规模的劳动掠夺

事件背景:纽约时报诉案文件被陆续解封 根据《纽约时报》周四报道并经法院解封的文件显示,微软员工曾在内部讨论OpenAI使用新闻文章训练模型的行为是否构成“人类历史上最大规模的劳动窃取”,甚至可能引发损害模型质量的“死亡循环”。这些文件出自《

事件背景:纽约时报诉案文件被陆续解封

根据《纽约时报》周四报道并经法院解封的文件显示,微软员工曾在内部讨论OpenAI使用新闻文章训练模型的行为是否构成“人类历史上最大规模的劳动窃取”,甚至可能引发损害模型质量的“死亡循环”。这些文件出自《纽约时报》于2023年底对OpenAI和微软提起的版权诉讼,目前已有另外十一家出版商加入原告行列。OpenAI方面全程抗辩,而诉讼已迫使其保存2000万条ChatGPT对话记录。纽约南区法院法官Sidney Stein正在审议即决判决动议,相关文件随之逐步公开。

内部备忘录的警示与微软的回应

一份2023年的微软内部文件写道,全球数百万人很快会认为大模型“吸走”他们的全部作品,是“规模空前的惊人盗窃”,同一作者还称大模型“是一种摧毁自身供应链的产品”。微软在法庭文件中回应称,这些备忘录由应用科学总监Brent Hecht撰写——他同时在西北大学任职——并不代表公司立场,且他并非决策者,其职责正是“呈现多元且不对称的观点”。

高管证词与OpenAI内部的分歧

微软CEO Satya Nadella作证称,“任何付费墙内容,想使用者都应获得授权”,并表示如果早知OpenAI用付费内容训练,他会行使微软的权利要求其重新训练模型。其发言人称这是就信息获取与消费发表的“宽泛原则”。而在OpenAI内部,有员工向总裁Greg Brockman报告构建了绕过《纽约时报》付费墙的“黑客手段”,对方回复“不错”。ChatGPT团队负责人Nick Turley曾于2023年6月写道,AI对出版商构成“生存威胁”,并称AI产品“越来越具替代性”。一名OpenAI工程师则在2023年2月指出,无论链接展示多显眼,用户都不会点击——这与聊天机器人能为媒体导流的说法相悖。时任政策总监Jack Clark在2020年就警告公司正在“创造替代社会文化定义者劳动的系统”,或将成为“硅谷鲁莽闯入生活其他领域、在地毯上留下一摊烂摊子”的象征。Clark后来联合创办了Anthropic。

争议焦点:合理使用之争

微软与OpenAI均主张训练行为属于合理使用,即将文章转化为新作品而非替代原作。代表《纽约每日新闻》等八家媒体的律师Steven Lieberman表示:“全世界将看到OpenAI和微软对自己行为正当性的真实想法。”《纽约时报》作为原告拒绝置评,OpenAI则未回应采访请求。

风险提示:本站内容仅供参考,不构成任何投资建议。数字资产价格波动剧烈,请谨慎评估自身风险承受能力。

评论

  • 暂无评论,快来抢沙发

相关内容