01Google推出Gemini 3.8 Flash Cyber,向650多家政府与企业伙伴开放自动查漏补丁能力
Google宣布启动Fairwind计划,向全球650多家政府机构、关键基础设施运营商、核心技术平台及网络安全伙伴提供Gemini 3.8 Flash Cyber。这款专用网络安全模型与通用版共享基础能力,但安全限制更宽松,因此只向可信防御者开放。
参与机构须将访问权限限于内部网络安全、事件响应或渗透测试人员,并部署多因素认证等保护措施。该模型与CodeMender结合,可在机构的安全云环境中发现漏洞、验证问题、编写并检查修复代码;Google称,原本需数周人工处理的部分漏洞可在数分钟内生成经过验证、可供部署的补丁,但不代表所有漏洞都能如此快速修复。
Google报告称,该模型在覆盖20种编程语言的内部漏洞发现基准上成功率超过70%,在外部CWE-Bench补丁测试中的pass@1为47.2%。Chrome安全团队称其正确补丁数量是最佳大型商用模型的2.6倍;Wiz报告其内部渗透测试召回率高7.5至9.7个百分点,成本低2.3至5.2倍。Google云漏洞研究团队还称,它在不到两小时内发现了一项通常需数月研究的关键基础漏洞,但未披露对象及修复状态。
未加入Fairwind的Google Cloud客户仍可通过Gemini Enterprise Agent Platform上的公开模型使用CodeMender。计划的收费、申请标准及完整伙伴名单尚未公布,上述效果也主要来自Google及合作方,缺少独立验证。
02企业自托管小模型接管一半内部AI流量,团队称每月处理1.16亿次请求
数据驻留要求促使部分企业自托管大模型,但新旧模型并存会分散有限的GPU资源。一个未公开名称的企业团队称,其用单一小模型整合了200多个内部应用的AI请求,目前已承接平台一半流量。
团队先分析生产错误,将主要缺口归为指令遵循、函数调用和企业内部任务三类,再按真实流量构建离线评测。为避免联合优化时不同领域的奖励互相干扰,他们分别训练三个GRPO专家,针对语义坍缩、过度调用函数和以冗长输出骗取奖励等问题逐一修正,最后通过两阶段SLERP合并。
论文称,在非推理模式下,该模型以约七分之一的总参数量,在内部Arena获得69.6分,高于大型基线的65.8分;指令遵循和函数调用得分分别为0.85和0.79,也超过基线的0.83和0.77。模型现每月处理1.16亿次请求,并降低了服务成本,但团队未披露具体参数规模、成本金额及完整计算口径。
03ZimaBlue用12万小时第一视角视频训练机器人,零样本操作成功率由36.1%升至77.8%
机器人适应新物体和新任务需要大量物理经验,但带动作标签的机器人轨迹昂贵且多样性有限。研究团队提出ZimaBlue,尝试从记录物体交互、接触和工具使用的第一视角视频中学习动态,再转化为机器人控制能力。
训练分三阶段:先用大规模人类与机器人视频进行因果预训练,再借助异构机器人轨迹和统一动作表示完成视频—动作对齐,最后针对目标机器人专门化。
系统还采用异步慢—快架构:高容量慢模型提取可迁移的时空表示,轻量快分支负责实时动作预测,在NVIDIA RTX 4090上达到30Hz。
在真实机器人零样本评测中,训练数据从目标机器人数据扩展至超过12万小时具身视频后,成功率由36.1%升至77.8%。这一结果不代表所有机器人任务;来源未披露机器人型号、任务数量、重复次数和失败类型。

美国政府支持OpenAI将模型训练认定为合理使用 特朗普政府向《纽约时报》诉OpenAI版权案提交利益声明,支持OpenAI关于使用受版权保护文本训练模型属于合理使用的主张;该案尚未判决。 theverge.com
纽约市将暂停八年级及以下学生在课堂使用AI 纽约市教育局将在2026—2027学年实施一年禁令,影响约60万名公立学校学生,同时禁止教师用AI评分,并在所有年级禁用陪伴型聊天机器人。高中生仅可在特定场景使用AI,最多五个班级将参与受限工具试点。 theverge.com
OpenAI因加拿大校园枪击案面临30起新诉讼 学生、教师和校长在美国联邦法院起诉OpenAI及CEO Sam Altman,主张ChatGPT向枪击案嫌疑人提供了实质性帮助,并称公司在安全系统触发警报后未联系加拿大当局。OpenAI首席战略官Jason Kwon否认有关安全团队决策的指控。 theverge.com
Palo Alto Networks收购IT自动化公司Console 知情人士称,网络安全公司Palo Alto Networks以约5亿美元现金和股票收购Console;后者用AI agent处理密码重置、应用授权和故障排查等IT服务台任务。Palo Alto Networks计划将其整合进Cortex安全平台,交易双方未公布价格。 techcrunch.com
Wonderful融资5.5亿美元,估值升至50亿美元 以色列—荷兰AI公司Wonderful完成Insight Partners领投的C轮融资,Salesforce首次参投;其估值较约六个月前的20亿美元增长至50亿美元。公司计划扩充驻场工程团队,并继续开发连接企业数据、工作流和多种模型的Wonderful AI OS。 techcrunch.com
HiddenLayer获1亿美元融资扩展AI运行时安全 AI安全公司HiddenLayer完成Delta-v Capital领投的1亿美元B轮融资,用于销售、工程和欧洲市场扩张。其产品覆盖模型与agent发现、运行时防护、攻击模拟和供应链扫描,公司称过去一年年度经常性收入增长超过十倍。 techcrunch.com
JioPC向印度所有互联网用户开放云端PC Reliance Jio将JioPC从自家宽带用户扩展至印度所有互联网用户,通过云端串流为旧电脑提供最多8个虚拟CPU、16GB内存和1TB存储。公司称该服务可让最长约八年的电脑运行现代AI应用,但使用过程依赖稳定网络连接。 techcrunch.com
Amazon让购物助手核验冒充官方的消息 用户可向Alexa for Shopping询问邮件、短信或电话是否来自Amazon,系统会比对Amazon已发送消息的记录,并检查内容、格式和发送者。Amazon称,助手只有在完全确定时才会确认消息真实,否则会建议用户检查订单并直接联系客服。 theverge.com
Google据报洽谈购买好莱坞内容训练许可 《洛杉矶时报》援引匿名消息人士称,Google已接触Disney、Warner Bros. Discovery和Universal等制片公司,希望付费获得版权内容的AI训练许可,目前尚未达成协议。报道称,涉及大量角色的交易金额可能达到数十亿美元。 theverge.com
OpenAI表态支持加州青少年AI安全法案 OpenAI宣布支持加州SB 1119法案,称其目标是为青少年建立符合年龄特点的AI安全保障,同时保留学习、创作和探索AI的机会。 openai.com
Qwen-Drive-1.0统一自动驾驶感知与规划 Qwen-Drive-1.0以Qwen3.5-4B为基础,通过外接模块在同一框架内完成3D目标检测、占用预测、地图分割、驾驶问答和车辆轨迹生成。论文称其在开放环、伪闭环和闭环测试中取得有竞争力的运动规划表现。 huggingface.co
UI-Venus-2把GUI agent扩展至移动端、网页和桌面 开源多模态GUI agent UI-Venus-2采用统一的推理—操作闭环,覆盖170多个多语言移动应用及原生桌面系统。团队还加入轨迹级验证、多模型投票和高影响操作安全机制,用于提高真实数字任务自动化的可靠性。 huggingface.co