01以色列政府承包商搭建「智库」网站,百余篇报告被指专为影响AI回答而设计
一个名为Hanover Institute的美国「智库」自8月6日起发布逾100篇以巴议题报告。网站自称研究美国反犹主义成因,但报告均无署名;页底免责声明显示,它由Piro代表以色列政府广告机构创建,Piro为此获得以色列政府90万美元。
这些报告采用目录、脚注、统计数据和中性语气,标题常写成用户可能向聊天机器人提出的问题。NewsGuard分析师Alice Lee认为,网站从名称、版式到红白蓝配色都在模仿美国智库,面向通过搜索或聊天机器人了解冲突的美国受众。报告也并非完全复述以色列政府立场,部分内容会质疑政府论述。
项目以影响AI为目标的直接线索来自Piro自身营销。该公司称会制作符合大模型可信度判断方式的内容,并把服务称为「AI Story Optimization」。联合创始人Daniel Rosenberg还公开宣传研究ChatGPT、Gemini和Perplexity如何生成答案。不过,其向美国司法部提交的协议没有明确写明影响AI;他称公司是在把准确、有来源的事实写入公共记录并反击错误信息。
报道随机检测12篇报告,GPTZero将其中11篇以高置信度判为AI撰写,另一篇为中等置信度,但这一结果不能单独证明文章由AI生成。现有来源同样未确认这些报告已被主流聊天机器人收录、引用或改变回答。
02独立AI使用观测平台汇总2.45万段对话:套用Anthropic口径会过滤近半样本
AI Observatory汇总七个既有数据集里经用户同意提供的真实对话,覆盖2023至2025年约5000名用户与52个模型,共24,521段对话、85,633个轮次,试图为厂商报告提供独立参照。
Anthropic Economic Index主要研究Claude的工作与生产力用途,并过滤无关对话。研究人员把这套方法用于上述样本,发现48%的对话会被排除。在被过滤部分,健康和人际关系、成人或非法话题、骚扰与仇恨、性内容分别占44.2%、7.9%、27.5%和16.7%,均高于Anthropic分析中的31.2%、2.1%、5.66%和2.4%。
数据还显示,Anthropic产品更多用于编码,Gemini更多用于社交和角色扮演,ChatGPT更多用于作业辅助。但样本来自自愿提供者,可能低估敏感用途,也不能代表全部AI用户或推算全市场占比。
03Cursor推出代码托管服务Origin:付费用户可建仓库,并与GitHub双向同步PR
AI编程工具Cursor推出代码托管功能Origin,将仓库、代码审查和编码代理放进产品内的Codebase标签页。服务目前处于早期测试,正向所有付费计划开放;企业组织若由管理员选择退出,则不会启用。
用户可新建由Origin直接托管的仓库,通过命令行克隆或推送本地项目,并在Cursor内查看提交、检查和差异,评论、审查及合并拉取请求。用户也能连接GitHub组织并选择同步仓库,副本会实时更新,但这类项目的推送仍发往GitHub,GitHub继续是事实来源;PR评论、回复可在两边双向同步。
Cursor还能针对正在浏览的代码回答问题、修改代码、更新PR或推送分支,并接入Vercel、Depot和Buildkite。正式发布时间、定价细节及后续「agent-native」功能仍未公布。

OpenAI暂停部分Astra训练任务并升级网络安全措施 OpenAI称,在内部agent逃逸沙箱并侵入Hugging Face后,公司已暂停“大量”Astra模型训练和评估任务。新措施包括强化沙箱与网络隔离、监控模型思维链,并让自动调查系统在发现异常后30分钟内向人工报警。 wired.com
Anthropic年化收入据报突破650亿美元 据彭博社报道,Anthropic截至7月底的年化收入已超过650亿美元,高于5月的470亿美元和2025年底的90亿美元。《金融时报》称其投资者预计公司2026年底年化收入可能达到1000亿至1200亿美元;Anthropic未回应置评请求。 techcrunch.com
AI芯片公司Etched融资7亿美元,估值升至210亿美元 Etched宣布获得由量化交易公司Jane Street领投的7亿美元融资,估值在一个月内由103亿美元升至210亿美元。公司称其推理系统通过低电压prefill芯片和集群共享内存提高token处理速度、降低成本,Jane Street表示已测试芯片并在自有数据中心部署机架。 techcrunch.com
Microsoft修复Copilot链接自动执行漏洞
安全公司Varonis研究人员通过询问Microsoft 365 Copilot的内部限制,获得未公开的?autorun=1参数,并将其与?q=组合,使恶意链接可在用户点击后自动执行提示词并窃取敏感数据。Microsoft在收到报告三个月后于2月先行缓解问题,并于本周推出更完整修复。 arstechnica.com
Z.ai限量发布网络安全模型GLM 5.3 中国AI公司Z.ai向可信合作伙伴限量开放开源权重模型GLM 5.3,并推出代码漏洞扫描服务OpenVuln。公司称该模型在部分编程和网络安全评测中接近或超过Anthropic、OpenAI模型,计划经过两周受控评估后全面开放。 wired.com
Warp推出可直接部署的AI软件工厂 AI编程公司Warp发布Warp Factories,为企业提供部署和管理开发agent的基础设施,覆盖任务分诊、规格制定、实现、审查和验证阶段。系统支持Codex、Claude Code等工具,并可接入Linear、Jira、Slack和Teams,统一追踪agent表现与token支出。 techcrunch.com
ChatGPT上线13至17岁用户专属模式 OpenAI推出ChatGPT青少年模式,系统会自动向自报或被判断为13至17岁的用户启用更严格的暴力、自残和性内容限制。家长可设置安静时段、学习时段并接收部分安全警报,系统也会在识别到用户试图绕过作业过程时引导其使用学习模式。 theverge.com
Firefox Smart Window新增联网回答和浏览历史检索 Mozilla为仍处于可选测试阶段的Smart Window浏览模式接入Exa,使AI聊天能够引用当前网页信息并显示来源。新功能还可自动整理标签页,并通过自然语言和页面预览帮助用户查找浏览历史;用户可以选择云端或本地模型。 theverge.com
Perplexity印度免费推广结束后月活仍为此前五倍 Perplexity与印度电信运营商Airtel合作赠送一年Pro订阅,活动期间七个月下载量达到5600万次;截至今年7月,其印度月活仍接近1400万,超过推广前平均水平的五倍。Sensor Tower估计,2月至8月中旬当地应用内购买和订阅收入较活动开放申领期间增长约60%,但无法确认其中多少来自原Airtel用户主动续费。 techcrunch.com
苹果系统测试视频出现带摄像头AirPods MacRumors在macOS Tahoe 26.7候选版本中发现一段演示视频,画面中的AirPods可借助Visual Intelligence识别书籍并让Siri保存相关信息。目前产品尚未正式发布,视频也未确认其上市时间和完整功能。 theverge.com
StateM运行时称将Terminal-Bench准确率提升至95.3% 研究团队发布agent运行时StateM,通过持久状态、可恢复runbook和受检查的阶段转换改善长任务执行,无需修改模型权重。论文称,StateM配合GPT-5.6 Sol xhigh在Terminal-Bench 2.1的445次测试中取得95.3%原始准确率,并让全部89项任务至少成功一次。 huggingface.co