Chrome六月修复量超过此前两年,卫星地图一句话改写

01调用方式不变,DeepSeek-V4-Flash公测当天迎来价格实测

7月31日,DeepSeek-V4-Flash API开放公测。已经接入的开发者无需改接口,只要把模型名设为「deepseek-v4-flash」,就能切到最新版。

这次更新没有换架构,模型规模也与预览版相同,只重新做了后训练。升级仅覆盖Flash接口,DeepSeek-V4-Pro以及应用端、网页端模型都没有变化。

官方同步公布了多项coding agent成绩,但测试采用尚未发布的最简框架,并把推理强度调到最高。开发者能先看到分数,却暂时无法完整复现这套测试条件。

第三方Artificial Analysis随后从智能、速度和价格三个维度测试新模型。其智能指数得分为50,同类模型中位数是25;整套评测生成了2.1亿token,同类中位数为1亿,输出量超过一倍。

价格则给出了更直接的选型锚点:每百万输入token收费0.14美元,同类中位数为0.43美元;每百万输出token收费0.28美元,中位数为1.20美元。该机构跑完整套智能评测共花费72.02美元。DeepSeek称Pro正式版将很快发布。

已有接口可直接切换长输出影响实际账单Pro用户仍需等待

02Chrome六月修复量超过此前两年,安全评估已牵出三起现实事件

六月,Chrome修复的安全漏洞比此前两年总和还多。Google称,LLM把自动化漏洞发现扩展到人类专家难以覆盖的规模,并用模型成批寻找和修补问题。

Chrome漏洞还要经过分诊、修复、发布更新,直到用户重启浏览器才算处理完。发现量突然上升,验证、发版和响应流程也得同步扩容。

另一边,把模型用于网络安全评估却带来反向压力。Anthropic正调查评估期间发生的三起现实事件。现有素材没有披露细节,但测试已不再只是实验环境内的问题。

两条流程不能混在一起:漏洞发现追求覆盖和速度,能力评估则要先限定目标、权限与隔离范围。Anthropic目前确认的事件数是三起,调查仍在进行。

浏览器安全团队先扩容分诊评估前先锁定授权范围三起事件的调查结论待定

03一句话就能改写卫星场景,Google Earth的地图界面成了合成内容载体

地图界面曾给图片附上一层可信感:道路、建筑和地貌彼此吻合,看起来就像某地真实发生过的事。如今,Google Earth的新AI只需一句提示,就能在卫星场景里加入难民、核电站或致命车祸。

过去,核验人员还能从空间错位、动作失真中寻找破绽,但这些线索正在变弱。VideoCoCo试图用可执行代码规划完整时空过程,让视频中的物体运动更符合物理规律。

多人画面仍会露馅:拥抱、搬运或扭打可能出现肢体融合、凭空多出的手脚。MPIE-Bench正是为测量这些解剖和几何错误而建,还发现现有视觉模型评分可能已经给出高分,人眼却仍能看出问题。

当空间关系、物理运动和人体接触都更合理,普通用户与媒体就不能再把「看起来对」当作核验依据。下一道门槛将落到来源、生成记录和原始素材,而不是肉眼判断。

媒体需核验地图来源普通用户更难凭画面识假平台需保留生成记录
04

OpenAI封禁柬埔寨诈骗团伙相关账户 OpenAI称,一个柬埔寨犯罪团伙利用ChatGPT支持投资、恋爱、赌博和冒充身份等诈骗活动,公司已中断其使用。 openai.com

05

三大唱片公司提议禁止AI歌曲进入排行榜 环球音乐、索尼音乐和华纳音乐等唱片公司提交排行榜资格规则,主张不让AI生成歌曲参与排名。 theverge.com

06

Snapchat不再奖励完全由AI生成的Spotlight视频 Snapchat调整推荐系统,只有真人创作的视频才有资格获得Spotlight推荐和相关奖励。 techcrunch.com

07

xAI数据中心的无许可燃气轮机还要运行近一年 SpaceX正为xAI的Colossus数据中心建设新电厂,但现有无许可轮机不会全部立即拆除,清理过程还将持续数月。 techcrunch.com

08

Smallest.ai融资1300万美元开发低延迟语音AI Smallest.ai获得1300万美元融资,用于开发超高速语音模型,目标是让AI电话中的合成语音更接近真人。 techcrunch.com

09

Science调查称头部AI初创公司的论文产出很少 Science报道称,多家估值和影响力居前的AI初创公司很少公开发表研究成果。 science.org

10

OpenAI公布面向欧洲AI治理的合规实践 OpenAI介绍其在安全、透明度、内容来源和系统防护方面的做法,并说明这些措施如何配合欧盟《人工智能法案》的推进。 openai.com

11

OpenAI提出覆盖模型、算力和产品的全栈路线 OpenAI发布「Building abundant intelligence」,提出从基础设施到模型和应用协同降低先进AI的使用成本并扩大覆盖范围。 openai.com

12

Qwen发布可跨图形界面与命令行执行任务的UI agent Qwen-UI-Agent面向真实设备操作,可跨平台执行工作流,并把图形界面交互与命令行操作结合起来。 huggingface.co

13

Metis尝试把长期记忆直接纳入基础模型 Metis提出「记忆基础模型」,把原本主要由外部模块实现的agent记忆能力内化到基础模型中。 huggingface.co