01高分人数激增5倍,5.8万名学生被迫重考
一场由AI监督的远程考试结束后,高分人数变成此前的5倍。最终,5.8万名学生被要求重考。无论个人成绩是否可疑,每个人都得重新付出时间,学校也要再次组织考试。
这次处理暴露的不是一道题判错,而是大规模监考缺少可供用户核查的过程。系统依据什么规则运行、怎样处理异常,学生很难看见;结果出了问题,补救成本便直接落到考生身上。
AISPA研究虽然针对大模型应用,却指出了相似的治理缺口。论文称,系统提示词决定基础模型在应用中的行为,商业产品广泛使用,却很少向公众或监管者公开。研究者因此提出面向用户的系统化审计框架,让外部能够检查系统究竟被要求做什么。
对考试部署方,门槛不该只是「模型能否监考」。上线前需要审计系统规则,考试中需要检测分数分布等异常,结果有争议时还要给学生申诉和人工复核入口。否则,自动化覆盖多少人,错误就可能同时波及多少人。
这次事故已经给出具体尺度:高分人数增至此前5倍后,补救办法不是复核少数异常成绩,而是让5.8万名学生再考一次。
02苹果要用禁令卡住OpenAI硬件,称另有11名前员工或涉案
苹果已在商业秘密案中申请初步禁令,要求阻止OpenAI继续开发据称基于苹果技术的人工智能设备或其他产品。它还要求对两名被指控的前员工等对象加快取证。
苹果称,调查又发现11名前员工可能是证人或与案件有关。文件还指称,有人在同事面试前讨论未发布产品的专有信息,也有人在面试前截取机密文件。这些尚未经法院认定。
OpenAI称诉讼「毫无依据」,并公布信息和消息记录回应员工相关指控。苹果则要先限制产品推进,再查清资料如何流动,双方对事实的表述正面冲突。
法院是否签发禁令,将先决定硬件项目能否继续推进。加速取证则会厘清这11人只是证人,还是面临更具体的指控。
03看到AI配图就怀疑正文,整段生成代码也让开发者重新手敲
一张AI配图省下制作时间,却可能让整篇文章多一道信任审查。一位个人博客作者直言,看到这类图片,他会怀疑正文是否也由模型生成;相比之下,他宁愿看粗糙的Microsoft Paint手绘图,因为至少能确认背后是人的想法。
代码生成把同一笔成本交给开发者。另一位作者仍用coding assistant跳过枯燥环节,但让工具一次写完整个功能后,他会感到迷失:功能虽然交付了,自己却没弄懂实现方式。
逐行审查也没有消掉这笔账。数百行防御过度、注释糟糕且藏着细小错误的代码,仍要由人读完;他的折中办法是把生成代码手工重打一遍,在输入过程中逐段恢复理解。
这不是所有团队的通用流程,却给效率评估加了两笔账:内容发布后的读者疑虑,以及代码合并前的理解时间。两位作者的选择很具体,一个不用AI配图,一个把生成代码重新敲进项目。

Anthropic据报与AI云公司Volta签署100亿美元协议
Anthropic近期连续扩充云计算合作伙伴,最新协议金额据报达到100亿美元。 techcrunch.com
得州暂停新建数据中心并启动审计
得州州长要求审查数据中心对电力系统的影响,州政府随即暂停批准新项目。 techcrunch.com
SpaceX的AI业务收入超过航天业务
SpaceX季度文件显示,其AI业务收入同比增长逾两倍至26亿美元,主要来自向其他AI公司提供算力。 theverge.com
AMD数据中心季度收入同比增长107%
AI算力需求推动AMD数据中心业务收入升至67亿美元,高于上一季度的58亿美元和去年同期的32亿美元。 theverge.com
阿里巴巴发布Qwen3.8-Max
阿里巴巴称Qwen3.8-Max是其规模最大、能力最强的模型,并向用户广泛开放。 theverge.com
英伟达牵头的AI安全联盟提出agent防御方案
Open Secure AI Alliance成立一周后成员已超过120家公司,并发布了针对AI agent攻击的防御提案。 techcrunch.com
AWS允许Superblocks嵌入客户私有云
AWS客户可在自己的私有云环境中部署Superblocks的vibe coding工具,无需把应用开发流程移到外部服务。 techcrunch.com
OpenAI公开GPT-Live实时语音系统架构
GPT-Live采用无需轮次切换的语音模型和低延迟架构,支持用户与AI持续交谈。 openai.com
OpenAI为ChatGPT Work和Codex增加教育插件
新插件面向中小学教师、高校师生,覆盖教学、学习、研究和开发等任务。 openai.com
Google与Kaggle的AI agent课程吸引35.3万人参加
这项免费课程指导学习者构建和部署AI agent,共有35.3万人参与。 blog.google