01研究称专有模型API的加密推理块可跨用户移植,公开日志中已解出个人信息与凭证
一项研究称,多家大模型供应商用于隐藏逐步推理过程的加密文本块,可能暴露模型资产和用户数据。这类API不在服务端保存完整推理,而是把加密块交给客户端,并由客户端在后续请求中再次提交;研究者发现,这些块未与特定会话、用户或模型绑定,可在同一供应商生态内互换。
研究团队据此设计了一种「解码越狱」:截取强模型生成的加密推理块,再注入同一供应商防护较弱的模型,迫使后者逐字输出明文推理,无须直接越狱强模型。论文称,该方法已在Anthropic、OpenAI和Google的模型上绕过反蒸馏机制。
团队还从公开代码仓库收集并解码315,320个推理块,发现367项个人身份信息和182项凭证。这些数字仅对应其采集样本,并非所有专有模型API的泄露总量。论文同时称,攻击可揭示模型最终拒答时隐藏的危险信息,也能把恶意提示完全藏入加密块,污染公开的agent运行记录。
开发者因此需要重新审视公开日志、会话缓存及推理块的留存和转发方式。来源未列明具体API、模型版本和仓库范围,也未说明三家公司是否已经修复,以及检出的凭证是否仍然有效。
02Anthropic将为新版Claude全球输出嵌入水印,具体检测方法仍待公布
Anthropic为履行其签署的欧盟《AI法案》第50(2)条透明度行为准则,将为2026年8月2日及以后发布的Claude模型加入内容标记,覆盖全球市场及Claude API、Claude、Claude Code、Claude Cowork和Claude Tag;旧模型何时支持尚未确定。
支持模型生成的文本会嵌入不可见水印,复制粘贴后仍会随文本传播,并可能经部分编辑后保留。Claude生成SVG、PNG、JPG等支持文件时,还会附加符合C2PA开放标准的签名来源元数据,用于表明文件经Claude处理并检查是否被篡改。
通过AWS、Google Cloud或Microsoft Foundry调用支持模型时,文本水印同样适用,但受平台功能限制,签名元数据未必可用。Anthropic尚未公布检测算法、可靠性指标和编辑后的保留率。检出标记不等于Claude原创;未检出也不能排除旧模型、重度改写、短文本或元数据被移除等情况。
03医学研究服务商自称「绝不用AI」,却被发现虚构专家并冒用真实研究人员身份
Research Gold向医学研究人员出售系统综述、荟萃分析和论文起草服务,宣称内容「100%人工撰写,绝不用AI」,并以博士评审和专业方法学人员的资历建立可信度。
404 Media核查发现,网站所列创始人及另外七名成员没有匹配其履历的网络或论文记录,头像也被判断为AI生成。另一页面则使用多名真实研究人员的姓名、简介和LinkedIn照片。被列名的证据综合科学家Jenny Berrio称,她从未同意加入,正准备要求下架;记者联系她后,该页面被删除。
记者致电时,自称「Sarah」的客服反复否认自己是AI,并持续推销服务。记者在线提交一个研究主题后,又立即收到疑似AI生成的研究设计回复及1900美元报价。目前仍无法确认实际经营者、客户数量,以及已交付研究是否由AI完成。

OpenAI开始在ChatGPT中测试广告 OpenAI称测试旨在支持免费访问,广告将被明确标注,不影响回答内容,并提供隐私保护和用户控制选项。 openai.com
OpenAI与AWS将Daybreak网络安全能力接入Amazon Bedrock 企业可通过AWS的生成式AI平台Amazon Bedrock使用Daybreak,支持网络安全工作流。 openai.com
NVIDIA发布Nemotron 3.5 Lightning及开源模型路由库 Nemotron 3.5 Lightning是一款面向agent任务的300亿参数混合专家模型,NVIDIA称其输出速度最高提升4倍。同步发布的NeMo Switchyard可按质量、延迟和成本需求,把请求自动分配给不同模型。 blogs.nvidia.com
OpenAI推出Linux版ChatGPT桌面应用 该应用以预览版在全球发布,支持ChatGPT、ChatGPT Work和Codex,官方列出的发行版包括Ubuntu 24.04与26.04 LTS、Debian 13以及Fedora 43和44。 techcrunch.com
成立两个月的River AI融资11亿美元 这家由xAI联合创始人Igor Babuschkin创办的AI公司完成由General Catalyst和AMP PBC领投的种子及A轮融资。River已提供支持强化学习和LoRA微调的开放模型API,主打让企业自行训练和部署模型。 techcrunch.com
Zoom修复可在会议中劫持参会设备的漏洞 安全公司A Security称,该漏洞可借Zoom标注功能在无需受害者操作、没有明显提示的情况下执行恶意代码;研究人员称使用公开AI模型、不到20次提示便完成了漏洞利用。Zoom已为Windows、macOS、Linux、Android和iOS版本发布修复。 theverge.com
ChatGPT与Gemini用户规模均突破10亿 Google称Gemini月度用户达到10亿;OpenAI则确认ChatGPT此前已突破10亿月度用户,并于7月达到每周10亿用户。两家公司采用的统计周期不同,相关数字不能直接比较。 theverge.com
OpenAI据报完成70亿美元员工股份回购 据彭博报道,这笔要约收购让员工获得流动性,并沿用OpenAI今年3月融资时的8520亿美元估值。OpenAI未在报道发布前回应置评请求。 techcrunch.com
Spotify将标记“AI Persona”并移出默认推荐 Spotify计划从9月中旬开始为以AI生成身份示人的艺人添加“AI Persona”标签,并默认排除其编辑推荐、算法推荐和个性化推荐;用户主动关注后仍可收到相关音乐。 techcrunch.com
苹果被曝测试iPhone照片来源验证功能 iOS 27测试版代码出现“Apple Reference Image”系统,可在拍摄时写入来源元数据,并通过Apple Private Cloud Compute验证照片。该功能目前尚未上线,测试版隐私说明显示其将默认关闭。 theverge.com
Google研究型医疗AI演示实时视频问诊 基于Gemini和Project Astra构建的AMIE可在视频中处理视觉及听觉线索、引导虚拟体检并实时进行诊断推理。模拟患者随机研究中,临床评估者对其多项核心能力给予积极评价,但Google强调该系统仍处于研究阶段。 blog.google
Anthropic未发布模型推进黎曼猜想局部结果 Anthropic称该模型协调60个subagent、测试650种思路,提高了黎曼猜想已成立范围的下界;结果由公司内部数学家核验,并用开源证明助手Lean形式化。该工作没有给出黎曼猜想的一般证明。 techcrunch.com