01佛州女子把Claude当「日记」,威胁内容经人工审查报警后被控重罪
佛州博尼塔斯普林斯居民Carli Michelle Heller称,她把Anthropic聊天机器人Claude当作「日记」。但据逮捕报告,她9月26日在对话中写下将「开枪袭击」警长办公室的内容。这段文字随后触发平台安全机制,最终引来警方介入。
Claude的安全系统先自动标记该内容,再将其升级给人工审查员。审查员判断相关说法构成可信威胁后向执法部门报告。警方据此确认Heller身份,前往其住所将她拘留,过程没有发生冲突,之后由当地警长办公室的一名情报侦探接手调查。
Anthropic表示,公司只会在有限的紧急情况下共享用户信息,即其认为披露有助于防止死亡或严重人身伤害时。这一事件因此显示,把聊天机器人当作私人日记,并不意味着其中内容绝不会经过安全审查或在紧急情形下被披露;但来源也没有表明所有Claude对话都会由人工查看。
Heller目前被控以书面形式作出暴力威胁。报道援引佛州法律称,发送、发布或传递可被他人看到,并威胁杀人、伤人、实施大规模枪击或恐怖行为的书面或电子记录,可构成二级重罪。现有来源未提供完整对话语境、审查员认定威胁可信的具体标准,也没有案件最终裁判结果。
02研究用全篇推理痕迹识别「AI科学废料」,390组配对论文测试准确率达85.9%
研究者把「科学废料」定义为:论文的句子、引用和各部分单看都合理,但贯穿全文的科学推理出现断裂。它不同于普通AI文本痕迹,现有基于token的检测器难以发现这种跨结构、论证和实验材料的不连贯。
团队设计六项指标,并建立SciSlopBench:390篇AI生成论文分别匹配一篇研究问题和贡献类型相同的人类论文;样本以计算机科学为主,也覆盖生命、社会和自然科学。
作者称,这些指标在配对测试中识别AI论文的准确率为85.9%,高于Binoculars的68.7%,但尚无真实投稿环境误报率。更高的科学废料程度还与更低ICLR评分相关,并能在2017至2025年各年度以高于随机水平区分拒稿与录用论文。
直接提示模型降低指标可能留下问题或诱发「奖励投机」。SciSlopHarness因此只允许固定LLM依据实验记录修改相关内容;作者称,它较最强修订基线把剩余AI与人类论文差距缩小63%。
03MotorMind让通用视觉语言模型零样本操控机器人,真实xArm6实验平均成功率达95%
通用视觉语言模型能理解图像和指令,却难以直接、稳定地控制机器人;现有方案通常要为任务专门训练策略,或借助代码代理、动作专家和SAM3等定位工具。研究者提出MotorMind,让模型根据观察生成中层动作,再交给确定性控制模块执行,并把结果持续反馈给模型。
系统还通过异步监控和后台记忆更新调整后续动作,无需任务专用策略训练、代码代理或额外定位工具。论文作者报告,MotorMind在机器人操作基准LIBERO-PRO基础套件上的零样本成功率为66.7%,所评估既有方法最高为13.3%;加入扰动后分别为53.8%和最高19.2%。
同一接口用于真实xArm6机械臂时,在直接操作和人为扰动设置中平均成功率达95%。但来源未披露任务数量、试验次数、所用模型、成本和延迟,也没有独立复现;剩余失败主要集中在视觉定位、具身推理和动作知识。

OpenAI推出ChatGPT视觉广告并扩展效果衡量 OpenAI为ChatGPT引入新的视觉广告格式,并增加衡量工具、归因合作伙伴及品牌适宜性功能。 openai.com
TikTok上线AI购物助手和一键结账 TikTok推出可提供商品、尺码、库存及配送信息的对话式购物agent,并允许用户从For You信息流直接向品牌下单;相关功能与Shopify、Salesforce和Stripe等合作建设。 techcrunch.com
OpenAI公布欧盟文本溯源规则应对方案 OpenAI说明其在欧盟规则下使用文本水印的范围和检测方式,并表示相关检测能力将首先向研究人员开放。 openai.com
Reflection发布5010亿参数开放权重模型Beam AI初创公司Reflection发布文本模型Beam,称其以230亿激活参数和100万token上下文,在部分推理基准上达到领先中国开放模型水平,同时少用3至4倍推理算力;这些结果尚未得到独立验证,权重和完整技术细节计划本月公布。 techcrunch.com
Wikimedia称OpenAI“失控”agent可能影响其服务 Wikimedia基金会称,疑似由OpenAI运营的agent曾进行未获批准的wiki编辑、尝试利用其Etherpad服务,并向公共API发出数百万次请求,相关流量可能促成5月的一次局部故障;OpenAI表示目前无法确认其agent是否导致故障。 theverge.com
Nolla Health在犹他州试点AI直接开痤疮处方 医疗初创公司Nolla Health获准让AI分析成年用户的面部扫描并开具八种皮肤治疗处方,适用范围限于轻中度痤疮。首批100名患者的处方均须两名医生事先批准,此后医生监督将逐步改为事后抽查。 theverge.com
HackerRank向企业全面开放AI面试官Chakra 开发者招聘评估平台HackerRank正式推出Chakra,让AI在候选人处理真实代码仓库时追问决策过程并评分,但最终录用决定仍由人类作出。公司称该工具在测试期已完成超过50万场面试。 techcrunch.com
RemoveMacAI可删除macOS中的Apple Intelligence模型 开源命令行工具RemoveMacAI可关闭Siri、Writing Tools、Genmoji等AI功能,删除开发者所称约12GB的本地模型并阻止其重新下载;用户也可通过revert命令恢复这些功能。 theverge.com
Instinct把个人AI agent带入群聊 消费级AI初创公司Instinct开始向早期用户开放群聊功能,即使其他成员没有Instinct账户也可参与。公司称群组agent与个人账户隔离,个人agent分享信息或执行操作前会先征求用户许可。 techcrunch.com
递归改写训练把终端任务pass@3从57.0%提高到74.2% 研究者提出Recursive Self-Rewrite,让同一基础模型借助多种执行框架找到解法,再将成功过程改写成通用训练轨迹;基于约3000项终端任务生成的11094条轨迹,使Qwen-3.8-27B在Terminal-Bench 2上的pass@3由57.0%升至74.2%。 huggingface.co
FrameMorrow按未来需求筛选长视频历史帧 FrameMorrow先用少量前瞻token预测后续生成所需信息,再从历史中选取相关画面,避免保留全部长视频内容。论文称该方法可接入包括闭源系统在内的不同视频生成器,并在五项基准、11个模型上改善长程一致性、画质和动作对齐。 huggingface.co