音乐出版商起诉Anthropic,追问Claude训练材料获取方式

01索尼音乐出版与华纳Chappell起诉Anthropic:指控其盗版获取作品训练Claude

索尼音乐出版、华纳Chappell等多家音乐出版商周五晚在加州北区联邦法院起诉AI实验室Anthropic,并将开发Claude系列模型的两名联合创始人Dario Amodei和Benjamin Mann列为被告。原告称,Anthropic未经许可取得受版权保护的作品并用于训练Claude,索赔范围涉及「数万件」作品。

诉状把争议重点放在内容如何取得。出版商指控Anthropic从MusixMatch、LyricFind等已付费获得歌词授权的网站抓取歌词;Mann还被指通过BitTorrent下载超过500万本盗版书,员工另从Pirate Library Mirror下载至少200万本,其中包括含有歌词和乐谱的书籍。法院尚未认定这些下载和抓取行为属实。

原告要求每件作品最高赔偿15万美元,并对每次删除可识别版权信息的行为索赔最高2.5万美元。若法院支持其主张并按最高标准裁定,总额可能达到数十亿美元,但目前没有任何赔偿金额获确认。

这一区分延续了此前Bartz版权案的核心问题:该案法官认为,用受版权保护的作品训练模型本身合法,但通过盗版取得内容不合法,并判Anthropic支付15亿美元。新诉讼试图沿着「获取方式」继续追责,同时也主张作品被用于Claude训练。Anthropic回应称不同意出版商的主张,将在法庭上积极抗辩。

Anthropic面临的风险不只来自模型如何使用作品,也来自训练材料的获取渠道数万件作品及版权信息删除指控可能把潜在赔偿推至数十亿美元下一步要看法院是否认定下载、抓取和删除版权信息的指控成立。

02Tracer.AI代表微软发出版权通知,Luanti应用被Google Play下架

开源体素游戏创作平台Luanti的Android应用目前已无法从Google Play下载。项目方称,原因是品牌保护公司Tracer.AI代表微软提交DMCA通知,指控Luanti未经授权使用Minecraft资产。Luanti由非营利社区开发,默认不附带游戏或游戏资产,用户可另行下载社区内容。

通知引用Minecraft Java Edition 1.9的美国版权登记编号,但据Luanti披露,没有列出任何具体涉嫌侵权的资产。项目方否认侵权,称应用不含Minecraft或其他专有代码和资产;仓库里的开发测试内容也已不再随正式版本发布。

Luanti还称,应用内ContentDB的第三方内容由志愿者人工审核,并考虑用传统感知哈希辅助发现版权问题,但最终仍由人判断。项目曾在2023年收到Tracer.AI的类似通知并申诉成功;Google、微软和Tracer.AI尚无回应,本次应用何时或能否恢复上架仍不明确。

Android用户暂时失去Google Play这一下载入口未指明具体资产的通知也能先触发下架,增加开源项目的申诉与分发成本下一步取决于Google的申诉处理结果。

03Debian表决不禁用也不背书生成式AI:贡献者仍须理解、审查和测试输出

Debian项目表决通过「负责任使用生成式AI」立场,为软件开发、维护、软件包、文档及项目发布的其他媒体贡献设定统一规则。生成式AI可能帮志愿者节省时间,但Debian既不背书,也不禁止贡献者使用这类工具。

新立场没有为AI辅助内容降低门槛。无论贡献由什么工具制作,提交内容都必须符合相同的质量、正确性、可维护性和法律合规标准。贡献者在把AI输出纳入Debian前,应理解其内容,完成审查和测试,并在需要时修改。

如果AI生成的代码、文档或其他材料出现错误或法律问题,责任仍由提交者承担,不能转移给工具。现有来源未说明违规认定、执行或争议处理的具体流程。

Debian贡献者可以继续使用生成式AI辅助工作,但必须自行承担核验成本维护者无需因制作工具不同而采用另一套质量标准下一步要看项目如何认定和处理不合规贡献。
04

OpenAI回应Cursor被SpaceX收购 OpenAI发布了针对Cursor被SpaceX收购一事的决定,但候选素材未提供决定的具体内容。 openai.com

05

芯片关税方案被指可能推迟美国数据中心项目 据Politico报道,特朗普政府正考虑扩大半导体关税范围,服务器等含芯片产品也可能被征税。行业组织CCIA估算,这种方案或导致美国到2030年约20%的数据中心项目推迟或取消。 arstechnica.com

06

诉讼指控xAI使用儿童性虐待材料训练Grok 一名以Jane Doe化名起诉的原告称,xAI生成了描绘她的儿童性虐待图像,并指控公司储存相关输出、将其继续用于训练Grok;这些说法目前属于诉讼主张。 arstechnica.com

07

研究者发现AI编码代理会安装文档引用的无人维护代码 研究者扫描6214个企业域名后发现,120个网站的llms.txt或llms-full.txt引用了未注册的软件包或域名;他们注册部分目标进行验证,收到数十家公司的回连,并从进程链发现Claude、Codex和Hermes参与了安装。 arstechnica.com

08

Meta测试机器人为数据中心插线和重启服务器 据多名现任及前员工透露,Meta正测试Kinova、ABB和Watney Robotics等厂商的设备,用于更换网络线缆、切断服务器电源和按下设备重启按钮。Meta未评论具体测试,但表示仍在培训和招聘数据中心工人。 wired.com

09

Greg Brockman被指接管OpenAI更多日常运营 The Verge报道称,随着多名高管离职,OpenAI联合创始人兼总裁Greg Brockman现已统管ChatGPT、Codex、企业业务和基础设施建设,成为公司事实上的日常运营负责人。 theverge.com

10

Meta眼镜在录制指示灯被遮挡时将停用摄像头 Meta可穿戴设备负责人Alex Himel表示,公司将更新AI眼镜,使录制期间一旦指示灯被遮挡,摄像头便停止工作。欧盟监管机构仍在调查这类眼镜的非自愿录制风险。 arstechnica.com

11

逾百家公司联署呼吁立即应对AI网络攻击 OpenAI、Anthropic等逾百家公司签署公开信,要求各组织把网络防御列为管理层的紧急事项,并呼吁政府向医院、供水机构和地方政府提供防御型AI;信中没有列出具体投入、期限或企业承诺。 wired.com

12

Cara遭三轮大规模抓取后与首名抓取者合作开发防护工具 艺术作品平台Cara称,其约1200万件公开作品曾被一名学生抓取,随后另有抓取者收集约850万条链接和12.3万张图像。首名抓取者删除数据集后,现与Cara创始人Jingna Zhang合作开发保护艺术家的开源工具。 wired.com

13

英伟达把AI基础设施布局扩展到GPU之外 英伟达正在推出Vera Rubin架构,以Vera CPU、Rubin GPU及存储和网络系统共同处理大规模AI计算。公司称Vera CPU在部分数据编排操作中带来最高约3倍提升。 techcrunch.com

14

OpenAI研究ChatGPT与批判性思维训练对学生作业的影响 OpenAI公布一项覆盖逾1000名学生的随机研究,考察ChatGPT和批判性思维训练对真实大学作业表现及原创性的影响;候选素材未提供具体实验结果。 openai.com

15

EDM音乐人通过声音和画面线索排查AI生成作品 电子舞曲制作人Max“H4RRIS”Harris等音乐人正公开分析疑似AI生成的歌曲,使用人声与旋律同步卡顿、持续嘶声及异常视觉画面等线索提出质疑。报道同时指出,部分被点名作品没有确定证据证明使用了生成式AI。 theverge.com

16

研究提出用游戏引擎验证世界模型训练轨迹 一篇预印本提出RLHEV训练范式,利用游戏引擎检查碰撞、物理、导航和可玩性,再结合开发者的接受反馈,为空间世界模型提供可执行的强化学习奖励。 huggingface.co

17

ACE框架用准确性、复杂度和多样性评估agent训练数据 一篇综述把agent交互数据拆分为环境、任务、轨迹和验证器,并提出ACE框架,强调数据生成应同时满足执行可验证、难度适配学习者及减少重复覆盖,而不只追求规模。 huggingface.co