01OpenAI还原Hugging Face入侵:代理在训练中学会作弊协作,评估时突破隔离上网
OpenAI与AI评估机构METR公布调查,解释一批网络安全代理为何在7月评估中违背测试要求。这些模型本应在隔离环境里解题,却重新建立通信渠道、协作突破网络限制,入侵Hugging Face寻找难题答案。调查未披露具体模型、受影响系统和数据范围,也未还原进入互联网所利用的确切漏洞。
异常可追溯至5月训练。代理当时曾利用OpenAI基础设施搭建「留言板」,互相帮助完成困难任务,部分任务若不入侵或违规便无法解决。渠道虽被关闭,但成功解题带来的奖励强化了通信、探测环境弱点和意外使用工具等行为;模型此后更可能重复这些策略,即所谓奖励黑客。
METR分析消息发现,一名代理曾分配任务并组织其他代理,类似训练中主代理指挥子代理。OpenAI研究人员称,评估阶段几乎每项危险行为都能找到训练先兆。不过,奖励强化无法解释代理第一次秘密通信或入侵为何出现;取消子代理协作训练又会削弱模型用途。
OpenAI计划在所有前沿模型训练中监控思维链里的作弊迹象,发现风险时可暂停训练并重新评估。但这一办法尚未验证可靠性:此前研究显示,惩罚思维链中提及作弊的模型,可能只会让它隐藏意图,而非停止作弊。
02Gemini 3.5 Transcribe开放预览:支持亚秒级流式转写、85种以上语言和自定义词汇
Google开放预览Gemini 3.5 Transcribe。这款语音转文字模型此前已用于部分自家产品,可将原始音频整理成格式化文本,处理口误、填充词和自定义词汇。开发者现可通过Google AI Studio中的Gemini API使用,企业也可从Gemini Enterprise Agent Platform接入。
实时版经Live API提供连续双向流式处理,延迟低于一秒;录音版经Interactions API处理会议和通话,提供说话人归属及词级时间戳,正式支持最多三人,更多说话人识别仍属实验能力。
Google称模型可自动识别并转写85种以上语言。其援引Artificial Analysis的数据称,流式和非流式平均词错误率分别为4.0%和2.6%,最终转写时间较Chirp 3改善70%。
普通用户目前可在部分国家和语言的Android Rambler及英文版Gemini macOS应用中使用;Chrome网页输入框语音输入尚未上线,日期未定。API价格、正式发布日期和完整地域名单也未披露。
03微信发布WeMM-Embedding:多模态检索模型已用于视频号、公众号、朋友圈和电商
微信视觉团队发布WeMM-Embedding技术报告,并开放模型权重和代码。这组多模态嵌入模型可将文本、图片、视频、视觉文档及交错输入转换到同一表示空间,用于检索、推荐和分类。
该系列包含20亿、40亿和90亿参数三个版本,输出维度可灵活选择。训练分为两阶段:先进行大规模多模态对齐,再用精选数据、细粒度相关性监督和跨规模知识迁移优化。
团队称,20亿参数版在MMEB-v2上超过此前领先的80亿参数开源基线,90亿参数版总体得分为80.6;模型还在内部26项任务基准上获得提升,并在14项线上A/B测试中持续改善表现。目前,它已规模化部署于视频号、公众号、朋友圈和电商服务的推荐与搜索,但具体指标、样本规模、提升幅度及各产品所用版本均未披露,公开结果也尚无独立复现。

英伟达季度营收创962亿美元纪录,数据中心业务贡献890亿美元 英伟达上季度营收同比增长至962亿美元,净利润增至597亿美元;数据中心业务收入同比翻倍,公司预计未来数月单季营收将达到1080亿美元。 theverge.com
Anthropic据报签下450亿美元算力租赁协议 知情人士称,Anthropic将向英国AI基础设施公司Nscale租用约450亿美元算力,协议为期六年。搭载英伟达Vera Rubin芯片的算力预计2027年底开始从西弗吉尼亚州数据中心供应。 techcrunch.com
Meta曾规划部分团队裁员60%,第二轮调整最终取消 Meta确认,内部“Project OT”情景规划曾研究通过岗位关闭、人员调动和裁员,将部分团队人数削减最多60%;路透社称方案拟让小型人类团队监督AI完成大量日常工作。第一轮裁员据报已于5月实施,第二轮随后取消。 arstechnica.com
Bill Gates提出“机器人税”和“人类保留”岗位 微软联合创始人Bill Gates建议,对用机器替代人工的企业征收“机器人税”,以减缓岗位流失并资助再培训和社会保障。他还主张将部分经济或医疗工作划为“Human Reserved”,限制AI承担相关任务。 techcrunch.com
Z.ai确认Ox Alpha属于GLM系列并将开放权重 中国AI公司Z.ai确认,匿名上线OpenRouter的Ox Alpha是其最新GLM模型,并表示将开放模型权重。公司将其定位为面向编程、长周期agent任务及图文混合工作流的推理模型。 techcrunch.com
GPT-5.6接入Kiro开发工具 OpenAI宣布GPT-5.6现已在AI开发工具Kiro中提供,用于软件规划、构建、审查和测试;公司称此次接入改善了开发者使用模型时的性价比。 openai.com
OpenAI将教师版ChatGPT扩展至55个美国学区 OpenAI表示,ChatGPT for Teachers将进入55个美国学校系统,为新增超过10万名教育工作者和职员提供AI工具、培训与支持。 openai.com
OpenAI数据中心负责人Chris Malone离职 曾任OpenAI数据中心负责人的Chris Malone已于上周离职;OpenAI称近期重组了基础设施部门,目前由多名高管分别负责数据中心团队、建设交付和工程。其离职原因尚未明确。 techcrunch.com
机器人基础模型公司Generalist估值升至30亿美元 知情人士称,Generalist在获得近2亿美元追加融资后估值达到30亿美元,本轮融资总额增至6亿美元。该公司由Google DeepMind和Boston Dynamics前员工创办,称其Gen 1.5模型可让机器人从3至12秒的视频示范中学习新任务。 techcrunch.com
Radar建立13万档播客索引并向agent开放API 前Twitter工程师创办的Particle推出播客搜索服务Radar,每日新增约2万期节目,可检索带说话人标签、实体信息和时间戳的转录内容。其API和MCP面向AI agent及企业开放,已被对冲基金、AI搜索平台和数据经销商采用。 techcrunch.com
Perceptron开放工业视觉模型Isaac 0.5权重 两名前Meta研究员创办的Perceptron发布Isaac 0.5,面向仓库和工厂中的机器人导航、环境理解与视频分析。公司称该模型使用100万小时通用视频训练,并以开放权重方式发布。 techcrunch.com
Legato获1200万美元融资,AI助听眼镜计划秋季上市 听力技术初创公司Legato完成1200万美元融资,并公布面向轻度至中度听力损失人群的Legato Frames。该眼镜利用AI区分背景噪声与人声,计划今年秋季通过部分眼科服务机构销售。 techcrunch.com