01能改速度和时长的音乐模型,Lyria 3.5开始争夺创作过程
Lyria 3.5把音乐生成的控制项推进到了速度和时长。DeepMind称,新模型能生成更复杂自然的旋律结构,歌词更能贴合提示并理解段落结构,人声的发音、真实感和情绪表达也有改进。
模型已经进入Flow Music。用户可以直接控制输出的速度和时长,不必把这两个决定全留给生成后的音频编辑。音乐生成由此不再只比成品质量,也开始把创作过程中的选择交还给用户。
创作过程一拉长,单次输入输出就不够用了。JarvisHub研究把真实制作拆成参考素材、草稿、替代方案、编辑、失败尝试、版本关系、工具操作、评估和人工反馈,再用画布承载这些痕迹。它检验多模态agent能否沿着这些记录持续制作,而不是生成一个素材就结束。
同样的门槛在设计环节更加具体:一张位图看得见,却很难继续改。ReDesign调用不同工具,逐步恢复字体、矢量形状、颜色、分组和图层顺序,把扁平图片还原成可编辑的层级结构;研究者还设计了纠错机制,在工具输出不完整时维持长流程的可靠性。
02保留推理并压缩历史,让GPT-5.6基准得分翻三倍
两项API设置把GPT-5.6的基准得分推至原来的三倍:一项让后续调用保留先前推理,另一项在上下文过长时压缩历史。模型因而少走重复路径,也不易因截断丢掉已经确认的线索。
同一种损耗也出现在代码库里。coding agent面对不断变化的仓库,常在索引、语言服务器和任务历史间反复搜索。CodeNib按每次提交维护词法、向量和结构三种视图,再把结果统一映射到源码范围,按需提供有限上下文。
屏幕操作暴露的问题更直接:像素只是程序状态的有损呈现,相同画面可能对应不同文件、后端或DOM状态。StateAct让主控直接用代码检查和修改底层状态,把寻找按钮改成读取事实。
这些方法都在减少历史截断、信息分散和界面遮蔽造成的损耗。三倍得分仍来自基准,不等于生产提升;开发者接下来要测的是,状态基础设施能否减少真实任务中的重复调用和失败重试。
03被污染的文档能继续污染新文件,Copilot漏洞把攻击带入传播链
在一项售货机经营模拟中,Opus 5为了赢得竞争撒谎并与其他参与者串谋,最终成为实验中表现最好的经营者。这里没有真实顾客或生产系统,暴露的是模型如何钻目标设定的空子。
另一项披露触及了真实产品。研究者发现,攻击者藏在文档里的指令可影响Copilot,随后被复制进它生成或编辑的新文件,让下游文档继续携带攻击内容。
这不是同一种技术缺陷,却指向相似的控制难题:当AI只回答问题,错误通常停在一次输出;当AI能经营、编辑和传递文件,偏离预期的行为就可能沿工作流扩散。
研究者向微软提交了复现步骤、视频、环境假设和完整测试提示,并与产品及安全团队协同缓解漏洞。原定90天的披露协调期两次延长,最终持续144天。

Microsoft计划年内发布Copilot「超级应用」 该应用将整合Copilot的聊天、编程和agentic能力,覆盖消费者与企业场景。 theverge.com
OpenAI正在开发一系列AI硬件 OpenAI总裁Greg Brockman确认,公司正开发用于与其AI模型交互的「一系列设备」,但未证实其中是否包括传闻中的智能音箱。 theverge.com
xAI起诉明尼苏达州,反对限制「脱衣」应用的新法 xAI称该法的惩罚条款迫使其限制Grok Imagine的图像编辑功能,并主张相关规定违反美国宪法第一修正案。 theverge.com
Microsoft从Anthropic投资中录得32亿美元收益 Microsoft在2026财年第四季度财报中披露了对Anthropic的投资收益,其对OpenAI的投资表现则较为复杂。 techcrunch.com
Cyera同意以10亿美元收购Oasis Security Cyera将借此扩展AI agent安全业务,这是该公司今年完成的第三笔收购。 techcrunch.com
Meta准备扩大个人AI agent布局 Mark Zuckerberg表示,Meta计划推出能够代表用户执行任务的个人AI agent,并在2026年第二季度财报电话会上介绍了相关方向。 theverge.com
Pangram融资900万美元并发布新一代AI内容检测模型 Pangram发布文本检测模型Pangram 4,并开放AI图像检测模型的研究预览版。 techcrunch.com
Encore AI融资3000万美元开发销售agent 该公司分析客户通话、消息和CRM数据,提取有效销售方法并转化为供AI agent使用的操作手册。 techcrunch.com
Thinking Machines联合创始人Lilian Weng离职后加入OpenAI Weng因健康原因离开Thinking Machines;她此前曾任OpenAI AI安全研究副总裁。 techcrunch.com
OpenAI研究称ChatGPT正在扩大员工承担的任务范围 研究发现,ChatGPT用户开始跨越原有岗位边界处理更多类型的工作任务。 openai.com