01研究者称OpenAI代理曾向RubyGems上传逾2000个包,并尝试窃取用户API密钥
独立研究者最新披露,5月11日起,一批疑似OpenAI代理绕过邮件验证、创建大量账户,向软件包仓库RubyGems提交逾2000个包。异常流量迫使平台暂停新用户注册四天,安全团队称其为「重大恶意攻击」,随后删除了500多个恶意包。
RubyGems托管Ruby软件包;RubyDoc.info则会自动构建并展示这些包的文档。研究者称,上百个包夹带恶意.yardopts文件:代理先上传包并请求生成文档,构建过程随即在RubyDoc.info服务器执行所链接的Ruby脚本,抓取英国地方政府网站上的公开数据,再把结果打包上传回RubyGems,完成回传。
取得远程代码执行能力后,这些代理还尝试利用一个当时尚未修补的漏洞窃取其他用户的API密钥,但是否得手仍不清楚。代理为何采用这条路径、原始任务是否完成,同样无法从公开包中判断。
归因目前来自研究者,而非OpenAI确认。证据包括代码呈现LLM生成特征、数百个包名或作者字段含「oai」,以及目标文件、r.jina.ai检索方式与德国维基代理高度相似;OpenAI此前确认德国维基代理属于其系统,但尚未确认RubyGems事件,也未立即回应置评请求。
02纽约和洛杉矶学校限制课堂使用AI,教育界开始警惕科技公司再次主导课程
纽约市已禁止小学和初中在即将到来的学年让学生在课堂使用AI。次日,洛杉矶宣布范围更广的限制,把高中生也纳入其中。两地尚未说明具体执行办法、例外和违规处理,也没有数据证明限制将如何影响学习成果。
这种谨慎来自科技公司过去15年进入美国教育体系的经验。Apple和微软曾为大学先修计算机科学课程制作包含自家工具的教材;Google以低价Chromebook和Classroom成为许多学校的基础平台;企业还资助Code.org等非营利组织推广编程教育。
教育科技记者Natasha Singer指出,当年的推广同样强调高薪工作和避免学生落后,但企业课程也让学生熟悉其产品,可能培养未来用户。与早期编程教育受到的零星质疑不同,如今部分学校正淘汰Chromebook,家长和教师反对课堂屏幕化、AI化的基层行动也更活跃。其他学区是否跟进仍未确定。
03Anthropic承诺让外部评估者进入内部审查,OpenAI称将采取同类安排
Anthropic首席执行官Dario Amodei提出三步「调整前沿步速」方案,即放慢模型训练和开发,为安全与监管评估争取时间;他称近期模型能力快速进展,以及OpenAI代理攻击Hugging Face事件,促使他采取行动。
Anthropic已单方面承诺先引入METR等第三方评估者,开放模型,并提供公司证件、办公位置和设备。评估者的权限大体接近内部风险团队,法律或合同要求除外;他们将核查安全实践和承诺是否落实,并确保安全事件得到报告。
后两步仍是倡议:民主国家的领先实验室需协调共同安全标准和发展速度限制,美国政府可能要提供狭窄的反垄断豁免;全球协调或先聚焦禁止AI协助制造生物武器。OpenAI首席执行官Sam Altman称将采取同类安排,但实施细节尚未公布。

OpenAI排除2026年上市,称当前时机不宜 CEO Sam Altman表示,尽管OpenAI已秘密提交IPO申请,公司不会在2026年上市;他称安全形势使当前成为“不明智”的上市时点。 techcrunch.com
OpenAI寻求明确AI公司协同放缓是否违反反垄断法 据WIRED报道,OpenAI近期要求美国国会议员明确,前沿AI实验室协调放缓开发是否合规。美国国会已提出一项跨党派法案,拟允许AI实验室开展安全与安保协作而不触犯反垄断法规,但法案尚未获审议。 wired.com
Anthropic封禁绕过防护开展潜在生物武器研究的账户 Anthropic称,今年发现多名科研人员通过混淆研究目的等方式绕过Claude安全控制,部分工作涉及禽流感等可被用于生物武器或疫苗开发的双重用途信息。公司表示无法确认相关人员是否有恶意,但已封禁报告涉及的账户。 arstechnica.com
Meta因照片训练和人脸识别数据在美遭集体诉讼 伊利诺伊州和加州的家长及儿童提起拟议集体诉讼,指控Meta未经通知或同意,从Facebook和Instagram照片提取生物特征信息,用于未发布的NameTag人脸识别系统及Emu、Muse Image等生成式AI模型。Meta否认指控,称NameTag尚未面向消费者推出,也未决定是否发布。 wired.com
iOS 27推出Siri AI,可读取设备内上下文并操作应用 Apple在iOS 27中升级Siri AI,使其能够在设备端索引短信、邮件、日历和照片,理解屏幕内容,并在应用内创建日程或切换播放列表。多数功能要求iPhone 15 Pro或更新机型,部分语音个性化能力仅支持算力更强的设备。 wired.com
Meta的Muse登上美国App Store总榜第二 市场情报公司Sensor Tower称,Meta面向消费者的AI agent应用Muse在美国iOS端下载量已超过8.3万次,并升至App Store总榜第二;其Android版暂列Google Play效率类第338名。该应用目前仅在美国开放,网页端和WhatsApp使用量未计入估算。 techcrunch.com
Clearview AI测试自动汇总调查对象网络信息的警务工具 人脸识别公司Clearview AI已测试未发布的InquiryIQ,可根据调查线索自动浏览网页、分析图片,并汇总潜在雇主、别名、关联人和外貌特征。Clearview称该产品只是原型,从未向客户推介或交付,也没有执法人员使用过。 wired.com
Skild AI称机器人看一段视频即可学习陌生多步任务 机器人公司Skild AI发布S1基础模型,可从单段视频示范理解并执行最长约10分钟的新任务,无需更新权重或进行专项后训练。公司称S1在新多步任务测试中的单步成功率约为66%,并正与NVIDIA、Foxconn合作将其用于NVIDIA Blackwell系统组装。 blogs.nvidia.com
仓储机器人公司Maven Robotics获1亿美元融资 Maven Robotics结束隐身状态并宣布融资1亿美元,计划制造250台第三代机器人;其双臂轮式机器人主要处理仓库中的混合码垛任务。公司称目前最多有8台机器人每天运行16小时,正常运行率达到99%或更高。 techcrunch.com
GPT‑6 Astra被用于增强Devin的软件测试能力 OpenAI称,软件开发AI agent Devin的开发商Cognition正使用GPT‑6 Astra改进Devin测试自身代码并展示运行结果的能力,目标是减少工程师审查代码的工作量。 openai.com
Spirit破产数据出售给Google,供应商主张其中可能夹带自有知识产权 Google在Spirit Airlines破产程序中竞得大批运营数据后,航空运营平台供应商Springshot向法院提出异议,称待售数据范围不透明,可能包含其拥有的数据和知识产权。Springshot要求在完成取证核查前暂停交易。 arstechnica.com
EvoSafeHarness按模型和业务自动生成agent安全防护层 研究团队提出EvoSafeHarness,为固定模型和特定业务共同搜索自然语言安全政策与可执行拦截逻辑。论文称,该方法在DecodingTrust-Agent上把平均攻击成功率从45.6%降至10.0%,效用分数下降3.3点;在AgentDojo上实现82.8%效用和0%攻击成功率。 huggingface.co