近半受访科学家每日用AI,省时却积压待验证假设

01Google调查:近半受访科学家每天使用AI,每周节省近7小时却积压更多待验证假设

Google最新公布的AI & Economy ATLAS研究显示,近半数受访科学家每天使用某种形式的AI。ATLAS是Google长期追踪不同职业、地区和生活场景中AI使用情况的项目;此次研究由Google、Google DeepMind与MIT FutureTech合作,分析了2600个专业AI模型,并调查600多名美国和英国科学家。

科学家使用的工具主要分为大语言模型和专业模型。Gemini等大语言模型广泛进入不同学科和任务,专业模型则更多用于生命与健康科学,以及特定领域的数据预测、生成和模拟。两类工具并非相互替代,而是在研究流程中承担不同工作。

受访科学家报告,AI每周为他们节省接近7小时,让更多时间可以投入研究。但这不是对实际工时的客观计时结果;来源也未说明具体抽样方式、学科构成和节省时间的测量方法,因此不能直接推及所有科学家。

提速也没有立即变成更多发现。研究发现,科学家仍需花费大量时间核验AI输出;模型帮助提出更多假设后,尚未检验的假设开始积压。实体实验和临床验证等下游环节无法同步加速,成为新的流程瓶颈。

Google据此认为,要把节省的时间转化为科研产出,可能需要重新设计研究流程。不过,研究尚未量化假设积压和验证瓶颈对最终发现数量的影响。

科学家可以更快完成前端分析和生成任务,但核验成本随之上升实验室和临床团队可能面对更多待验证工作下一步要看科研流程调整后,节省的时间能否真正增加发现。

02AI代理开始自行发邮件、带钱包跑业务,404 Media记录互联网遭遇的新一轮自动化骚扰

科技媒体404 Media称,近几周收到多封自称由AI代理自动发送的邮件,另有更多邮件署名人类却明显由AI生成。AI代理不只在聊天框答题,还可获准使用邮箱、账户、手机或银行账户,在网上主动执行任务。

其中,名为Kudzu的代理来信称,它读过该媒体文章后主动反驳;创建者要求它赚钱,但投入147.17美元算力后收入仍为零。其他推介包括能在视频会议中发言和行动、持钱包自主付款、替记者采访,以及自动生成并推广音乐的代理。

还有代理发现网站未在robots.txt中屏蔽它,随即推销399美元的AI爬虫拦截审计。这些尝试把失败实验和推销的筛选成本转给收件人;企业AI客服和内容审核也已出现删除账户或封禁用户的情况。不过,报道未独立验证所有邮件是否真由代理自主发送,也未公布邮件总量、增长率或相关封禁规模。

收件人要承担更多筛选自动推销的时间成本钱包和账户权限会扩大代理误操作的影响下一步要看平台能否识别代理及约束其权限。

03Vidu S2把视频生成推进实时交互:720p虚拟角色可边对话边换装换场景

Vidu S2试图把一次性生成的视频变成可持续操控的视频流。它由互动数字角色模型S2-Avatar和实时视频编辑模型S2-Editing组成;相比Vidu S1,新版增加实时720p生成、随时更新参考图像和更强的动作指令遵循能力。

团队称,S2-Avatar能以每秒25至42帧生成互动角色视频。用户可在对话和生成过程中加入新参考图,让角色换装、与物体互动或切换场景,不必重新制作整段视频。S2-Editing则直接处理输入视频流,可实时改变风格、服装、角色和背景,同时保留原视频的动作与时间节奏。

两套模型还被扩展至立体空间视频,以支持沉浸式VR内容。团队称Vidu S2在五个公开基准上均领先,并已提供在线演示和API;但来源没有披露运行硬件、延迟测量方法、价格或许可,也没有独立测试验证实际稳定性。

虚拟角色和直播制作可在生成过程中直接调整内容,减少重做成本视频编辑从离线处理转向实时输入输出下一步要看独立测试能否复现其速度、质量与稳定性。
04

Google推出Gemini 3.8 Live系列语音模型 Gemini 3.8 Live面向规模化语音agent,支持近实时视觉理解、97种语言自动切换及后台工具调用;Extended Thinking版本可边推理边语音反馈任务进度。两款模型已开始向开发者和部分消费者推出,企业版处于私密预览。 deepmind.google

05

Salesforce与Nvidia推出企业推理模型Koa Koa基于Nvidia开放权重模型Nemotron后训练,面向销售、营销和客服任务,将作为Agentforce平台的可选模型。Salesforce称训练使用模拟客户场景的合成数据,没有使用真实客户数据。 techcrunch.com

06

Meta推出跨三款社交应用的AI订阅Meta One Meta One覆盖Facebook、Instagram和WhatsApp,Core与Premium套餐月费分别为7.99美元和19.99美元,提供更多图像、视频生成及AI编辑用量。Meta未公布固定用量上限,称限制可能随国家、使用场景和系统状况变化。 techcrunch.com

07

WhatsApp Business开放MCP服务器,让AI agent代办接入配置 Meta推出WhatsApp Business Tools MCP,可连接Claude、Cursor、Codex或ChatGPT等AI编码agent。agent可创建企业账户、添加和验证电话号码、注册Cloud API、制作消息模板,并测试消息、webhook及检查配置故障。 techcrunch.com

08

Perplexity让GPT-6 Astra参与软件修改和生产系统监控 Perplexity使用Astra编写通信内容、修改软件并监控生产系统。OpenAI称,与较早模型相比,这些端到端任务需要Perplexity人员介入检查的频率更低。 openai.com

09

美国数据中心2035年天然气日需求预测升至180亿立方英尺 BloombergNEF预计,美国数据中心到2035年每天可能消耗约180亿立方英尺天然气,接近其九个月前预测的两倍;其中并网数据中心预计将推动电力行业日需求增加150亿立方英尺。 techcrunch.com

10

AI搜索营销公司Profound融资1.8亿美元 帮助品牌分析并提升其在AI搜索结果中曝光度的Profound完成D轮融资,估值18亿美元,由Sequoia和Kleiner Perkins领投。公司称其过去六个月收入增长两倍,目前拥有逾1000家企业客户。 techcrunch.com

11

AI工作流自动化工具Relay停止运营 定位为Zapier替代品的Relay已全面关闭,其产品曾让用户通过AI agent自动处理邮件和任务流程。报道指出,OpenAI、Google等大型平台把类似自动化功能直接纳入自家产品后,Relay难以维持独立产品定位。 techcrunch.com

12

PhysBrain 1.5统一环境理解、机器人动作与未来画面预测 这款8B具身基础模型把语言回答、机械臂末端动作和视觉目标编码为离散序列并联合训练。团队称其在28项具身理解基准上的平均得分为72.5,并可生成动作轨迹以及预测RGB、深度和机器人掩码画面。 huggingface.co

13

ZGCM-1开放7B模型权重、训练代码及数据配方 ZGCM-1面向数学推理和agent搜索,支持256K上下文,并结合内部推理与外部工具调用。团队称其16K预训练达到同等损失的效率提高约4.2倍,同时开放各训练阶段权重、中间检查点、数据及训练日志。 huggingface.co

14

Grouped Value Attention将持久KV缓存缩小约45% Grouped Value Attention仅缓存分组后的value,并通过学习到的线性映射重建key;研究者报告,在所测配置中,其持久缓存标量数量较匹配的GQA减少约45%至47%。350M参数实验的任务平均准确率接近GQA,端到端推理性能仍在评估。 huggingface.co