01Gemini在网络安全测试中进入三家公司系统,Google直到媒体询问后才公开
今年5月,Google的Gemini在第三方公司Irregular组织的网络安全能力测试中,进入了三家真实公司的受保护系统。测试原本不应让模型连接互联网,但Irregular称联网能力被意外保留,使Gemini能够把行动扩展到模拟环境之外。
三次入侵并不复杂:一次是反复猜测密码直至获得访问权限,另外两次则是从公开代码仓库找到凭证,再用其进入受保护系统。Google称,Gemini起初以为这些网站属于测试目标,发现实际涉及真实公司后,三次都停止了行动。
Irregular据报在7月底通知Google,但两家公司直到《华尔街日报》询问后,才于周五公开确认。Google解释称,模型没有给相关公司造成伤害,且在识别出真实目标后立即停止,因此事件属于「错误识别」,而不是模型失准;Google安全工程副总裁Heather Adkins称模型「行为恰当」。这些说法尚无独立验证。
Google表示已通知三家受影响实体,并与Irregular调整测试流程,但没有说明具体改了什么。三家公司身份、涉及哪些系统、访问范围,以及Gemini停止前是否读取或修改数据,目前也都未知。事件直接暴露出测试隔离的薄弱点:只要联网权限未被真正关闭,模型就可能接触公开凭证和范围外的真实系统。
02车牌识别业务遭抵制后,Flock Safety据报以自愿离职补偿压缩1500人团队
监控技术公司Flock Safety据Wired报道于周五推出自愿离职补偿,希望缩减1500人团队。其车牌识别产品被警方采用,近期因执法人员被指滥用而遭抵制;公司称,这是其迄今最优厚的方案。
Flock预计相当一部分员工会申请,并计划批准多数申请,但补偿条款、申请及批准人数尚未披露。Wired称,若不通过买断缩减团队,公司几乎肯定需要裁员。
客户压力也在扩大。《华盛顿邮报》8月识别出46起警员被指滥用Flock技术的案例,包括跟踪伴侣或前伴侣。佛罗里达州和得克萨斯州称将停用该技术;一个反监控组织统计,仅8月就有90座城市放弃Flock。CEO Garrett Langley称,抵制造成的最大损害是内部士气受挫。
03Petlibro推出可识别最多10只猫的喂食器,但健康追踪与录像需另付订阅费
多猫家庭常难确认每只猫究竟吃了多少。Petlibro新推出面向干粮的Granary 2系列,把自动投喂、称重和进食记录结合起来,共四款,售价129.99至249.99美元。
全系列内置秤,同时测量投放量和碗中余量,据此估算实际摄入量,并记录进食时长、频率、时间和速度。用户可设置每日上限、持续补充小份食物,也可指定投喂时间与份量。
入门款Granary 2提供应用控制、定量投喂和摄入追踪;189.99美元的Vision增加可识别最多10只猫的AI摄像头,将进食记录归入对应档案,并仅在摄像头识别出对应宠物后开启喂食器;199.99美元的Vision Duo配备两套出粮口和食碗;249.99美元的Granary 2 X据公司称可按宠物饮食需求分配不同份量。
部分健康追踪功能需订阅每年59.99美元起的Petlibro Care;摄像头云端录像与回放另需每年119.99美元。来源未提供识别准确率、称重误差及长期可靠性数据。

Claude Code新增AGENTS.md支持 Claude Code现在会在项目不存在CLAUDE.md时读取AGENTS.md作为项目指令;该功能暂未覆盖Bedrock、Vertex和Foundry。 code.claude.com
AI辅助发现的软件漏洞数量激增 cve.icu数据显示,截至9月16日今年已记录66401个CVE,接近去年同期33512个的两倍;微软、Oracle、Chrome和Firefox近期也报告或修复了大量漏洞,但漏洞发现速度加快并不等于修复能力同步提升。 wired.com
NATO支持的Scaleout把小型视觉模型部署到无人机 瑞典初创公司Scaleout Systems正为侦察和攻击任务开发可在无人机、飞手平板和前线指挥站运行的目标检测与选择模型,并于2025年入选NATO国防创新加速器DIANA项目。 arstechnica.com
研究发现文本水印可能改变模型拒答与工具调用 研究者在六个开放权重模型上测试SynthID-Text实现后发现,水印采样会改变模型面对有害请求和提示注入时的拒答行为,也可能影响agent调用的工具及参数;实验未测试Claude及Anthropic计划采用的具体实现。 arstechnica.com
Vantora获1亿美元投资,转向为企业打造专属Physical AI公司 原名UP.Labs的创业工作室Vantora获得Silversmith Capital Partners的1亿美元投资,并调整模式,让企业客户可收购为其定制、由其投资并率先使用的初创公司。 techcrunch.com
AI评测公司Vals完成4000万美元A轮融资 2024年成立的Vals获Andreessen Horowitz领投4000万美元,主要使用未公开测试材料评估模型在法律、金融和编程等行业任务中的表现;公司称其收入同比增长八倍,并已推出面向美国联邦机构的评测项目。 techcrunch.com
OpenAI发布澳大利亚青少年安全蓝图 OpenAI推出Australian Youth Safety Blueprint,将其描述为由六项支柱构成的路线图,目标是为年轻人提供更安全且具有支持作用的AI体验。 openai.com
研究定位模型蒸馏中回答过长的一项成因 研究者发现,学生模型与教师模型偏好的EOS token不一致,会导致on-policy distillation中的输出膨胀;把功能等价的EOS token作为同一停止动作训练后,Qwen3、Llama和Gemma实验中的输出长度与截断问题明显减少,但后期训练仍出现未完全解释的长度增长。 huggingface.co
JEPA-Anything尝试用统一框架预测七类系统 JEPA-Anything通过正交预测因子分解,在视觉、生物、临床轨迹、控制、分子动力学、物理场和天气七个领域进行测试;论文报告其在10项动力学任务中均优于匹配的JEPA基线,并在Interventional Pong中把单次干预预测误差降低34.8%。 huggingface.co