美国边境监控区逾千人未被接触、最终死亡

01调查记录逾千人穿过美国边境监控区后未被接触、最终死亡,部分人处于AI塔监视下

美国过去25年斥资数十亿美元,在南部边境部署监控塔组成「虚拟墙」,目标是发现、拘捕越境者并协助救援。MIT科技评论与《圣迭戈时报》历时15个月调查,记录逾千人穿过监控区后未被接触或拘捕、最终死亡;部分人还在可自动识别人的新型AI塔覆盖下。

团队分析2015年以来的案例,合并多个组织和十多个机构的记录;每例至少须确认死者被认为正在越境、遗体位置及大致死亡时间。塔位以电子前沿基金会的地图为基础,再用卫星图像核实位置和约略安装时间。对近600座塔的比对显示,塔附近死亡者超过1050人。

已发现的失效包括设备损坏、算法未识别人,以及执法人员未响应警报。但「死在塔附近」不等于「由技术失效致死」,材料也未说明每次警报为何无人处理。得州部分县记录缺失、损坏或未提供,县警长资料还会漏掉其他警察经手的案件。

政府称现有约800座塔,调查无法取得全部塔位和运行时间,因此1050人仍可能是低估。消息人士称,海关与边境保护局从未结合塔的运行记录和附近死亡做全面审计;死亡追踪不完整,技术促成拘捕的数据也不可靠。政府仍计划投入10亿美元,到2034年将虚拟墙扩大至三倍。

越境者可能在监控覆盖下仍得不到救援纳税人难以判断数十亿美元系统是否有效扩建前能否补齐死亡追踪和技术审计仍待观察。

02Anthropic发布Claude Opus 5.5,称典型工作负载成本较Opus 5降低40%

Anthropic发布Claude 5.5系列首款模型Opus 5.5,将其定位为新的领先模型,面向编码和agent等长时任务。公司称,模型默认设置下处理典型工作负载的成本比Opus 5低40%,输出速度快逾30%。

输入、输出价格分别降至每百万Token 4美元和20美元,单价均下降20%;40%的整体降幅还计入了每项任务使用更少Token,以及缓存读取价格下降60%至0.20美元。Anthropic同时提高Pro、Max、Team和按席位计费Enterprise方案的五小时限额,但未公布新额度。

在内部HAProxy代码重写测试中,Opus 5.5用9.5小时完成任务,比Fable 5.1快2.5小时、成本低51%。Claude Code和Claude Platform另有最高2.5倍速度的Fast模式,输入、输出价格为8美元和40美元。

安全方面,Anthropic称模型更少执行难以逆转或越权的操作,抗提示注入能力强于Opus 5,并接受Frontier Design和METR的发布前评估。生物研究访问须由合格机构申请验证,网络安全验证计划将在未来数周扩大。

开发者运行长时编码agent的Token成本和等待时间可能下降订阅用户可获得更高限额,但具体增幅仍未知实际生产环境的成本与安全表现仍待独立复现。

03TypeSafe AI推出Jev:不生成文本,只为分类与决策返回概率

TypeSafe AI上周推出决策模型API Jev。它接收文本或半结构化数据,却不像生成式大语言模型那样写回答,而是针对分类与决策问题返回数值和置信度。

开发者可把字符串、字符串数组或键值对组成一个「state」,再提交多个问题:是非题返回0到1的置信度;选择题返回所选答案及全部选项的概率分布;评分题按用户定义的等级给出浮点分数。

同一份状态可在上下文窗口内并行处理多个问题,耗时应与单题相近。Jev仅收输入费,每百万Token 0.042美元,适合垃圾邮件识别、标签建议、排序和搜索结果重排等批量分类工作。不过,置信度不等于经过校准的事实概率;Jev也不解释哪些信号影响判断,使评测和偏差排查更困难。其文档还承认,目前不擅长数字、日期和对抗性内容,且暂无独立基准或生产稳定性数据。

批量分类的调用成本可能下降高风险决策仍需额外评测偏差下一步要看概率校准和生产环境表现。
04

OpenAI发布GPT-6 Sol与Luna,API价格降至上一代一半 Sol面向编码等复杂任务,Luna面向摘要、信息提取等高吞吐任务;OpenAI称两款模型效率和准确性均有提升,现已向多数付费用户及API客户开放。 techcrunch.com

05

Qualcomm旗舰手机芯片支持本地运行300亿参数MoE模型 Snapdragon 8 Elite Gen 6与Extreme版本加入面向AI agent的感知中枢,可在设备端处理语音、区分说话者并积累使用记忆;Extreme版本最高支持本地运行300亿参数的混合专家模型。 techcrunch.com

06

Nscale申请赴美上市,约85%合同额集中于微软和Anthropic 英国AI云服务商Nscale披露逾1030亿美元合同,其中约85%来自微软和Anthropic;公司上半年收入1.406亿美元、净亏损10.2亿美元,并计划在纽交所上市。 techcrunch.com

07

Snorkel AI融资3.5亿美元,估值升至35亿美元 这家为AI实验室和企业制作训练数据及模拟环境的公司称,其年化收入运行率过去一年增长18倍至3.75亿美元;新一轮融资由Insight Partners和S32领投。 techcrunch.com

08

Rabbit推出脱离R1硬件运行的OS3 agent OS3在云端运行,可跨Windows、Mac和Linux设备调用文件、应用及用户选择的模型完成任务,一个账户最多连接五台设备。Rabbit创始人Jesse Lyu称公司已停止生产R1,但仍计划推出运行OS3的新硬件。 theverge.com

09

Meta承认Muse产品受OpenClaw启发,但称代码从零构建 Meta超级智能实验室产品负责人Nat Friedman表示,消费级AI agent Muse“很大程度上”受到开源项目OpenClaw启发;对于两者工作区文件名及部分内容近似,他称团队认为OpenClaw的设计是正确的。 techcrunch.com

10

AstroForge计划让AI自主控制2027年发射的航天器 这家小行星采矿技术公司开发了名为Solo的自主控制栈,结合传统控制算法、子系统模型及读取约2500个传感器的transformer模型。Solo将先在DeepSpace-2任务中以“影子模式”测试,再用于计划中的Autonomy-1任务。 techcrunch.com

11

OpenAI为GPT-6增加prompt缓存诊断与显式断点 OpenAI称GPT-6的prompt缓存提高了命中率,并新增诊断、显式断点和控制选项,以帮助API开发者降低延迟与成本。 openai.com

12

OpenAI提出前沿模型第三方安全评估原则 OpenAI主张第三方评估应兼顾严格性、安全性和独立性,用于检查前沿模型及其防护措施。 openai.com

13

RoboDawn让视觉语言模型无需专项训练控制机器人 研究团队设计了一组离散的移动、旋转和夹爪指令,使视觉语言模型通过观察与反馈闭环操作机器人;在RoboTwin 2.0 C2R测试中,成功率由零样本的53.2%升至单示例的73.6%,并已在Franka实体机器人上完成抓取与堆叠任务。 huggingface.co