MyBlog

AI 与科技日报|2026-09-26

AI 与科技日报|2026年09月26日

> 本期聚焦:OpenAI 学院两周年与乌克兰网络防御支持、Anthropic 与埃森哲的 AI 安全合作、DeepSeek 智能体论文、阿里 Qwen-Audio-3.1 发布,以及两篇值得关注的 arXiv 论文。

今日要点

  • OpenAI 宣布 OpenAI Academy 成立两周年,并扩大 AI 技能普及范围;同时将 Daybreak 项目访问权限扩展至乌克兰政府,用于民用基础设施网络防御。
  • Anthropic 方面,埃森哲(Accenture)加入其 AI 安全评估工作,外界关注评估能力能否转化为商业收益。
  • DeepSeek 发布最新智能体论文,梁文锋署名,披露单集群每天运行 300 万个沙盒,并涉及防止 AI“作弊”的机制。
  • 阿里云 发布语音大模型 Qwen-Audio-3.1,并宣布全系降价,最高降幅达 95%。
  • arXiv 上两篇新论文分别关注时间序列预测系统 TW3Cast 与混合推理模型中的“思考泄漏”问题。

新闻速览

1. OpenAI Academy 两周年,扩大 AI 技能普及
OpenAI 发文纪念 OpenAI Academy 成立两周年,称正将 AI 技能带到更多社区。
来源:OpenAI News

2. OpenAI 将网络访问权限扩展至乌克兰,用于民用防御
OpenAI 宣布将 Daybreak 项目的访问权限扩展至乌克兰政府,以支持民用基础设施的网络防御。
来源:OpenAI News

3. 埃森哲加入 Anthropic 的 AI 安全评估工作
据 Yahoo Finance 报道,埃森哲(ACN)加入 Anthropic 的 AI 安全努力,报道同时提出疑问:评估能力能否转化为利润。
来源:Yahoo Finance

4. DeepSeek 最新智能体论文:单集群每天运行 300 万个沙盒
据澎湃新闻报道,DeepSeek 发布最新智能体论文,梁文锋署名,论文披露单集群每天运行 300 万个沙盒,并涉及防止 AI“作弊”的设计。
来源:thepaper.cn

5. 纽约时报中文网:中国在 AI 安全上真正在乎什么
纽约时报中文网刊文讨论中国在人工智能安全议题上的实际关切。
来源:cn.nytimes.com

6. 阿里发布 Qwen-Audio-3.1,全系降价最高 95%
据新浪财经报道,阿里在云栖大会期间发布语音大模型 Qwen-Audio-3.1,并宣布 API 服务全系降价,最高降幅达 95%。
来源:新浪财经

7. arXiv:TW3Cast 用冻结路由实现时间序列预测
论文提出 TW3Cast,一个不使用智能体、也不使用语言模型的时间序列预测系统,在 GIFT-Eval 基准的 130 个条目中按平均 MASE 排名位列第 3。其选择表在训练集上计算一次后冻结,专家模型为公开基础模型的轻量微调版本。
来源:arXiv:2609.28506

8. arXiv:混合推理模型中的“思考泄漏”因果审计
论文提出“思考泄漏”概念,用因果中介框架审计 NoThink 后训练的效果。在三个模型、三种后训练方法和竞赛数学基准上,研究发现泄漏真实、具有因果性且影响显著。
来源:arXiv:2609.28682

9. Hugging Face:LFM2.5-VL-DSpark 加速视觉语言模型
Hugging Face 博客发布关于 LFM2.5-VL-DSpark 加速视觉语言模型的内容。
来源:Hugging Face

趋势判断

  • AI 安全从“原则”走向“工程与商业”:Anthropic 与埃森哲的合作、DeepSeek 论文中对“作弊”的防范,以及纽约时报对中国 AI 安全关切的讨论,共同指向一个趋势——安全议题正在被拆解为可评估、可外包、可量化的工程问题,并开始与商业收益挂钩。
  • 推理效率与“思考”的边界成为研究热点:TW3Cast 用冻结路由、不依赖智能体和语言模型取得高排名,与“思考泄漏”论文形成有趣对照:一边是压缩推理成本,一边是审计推理行为是否被后训练“借用”。效率与可解释性正在同时被推进。
  • 模型能力竞争叠加价格竞争:阿里 Qwen-Audio-3.1 发布即宣布最高 95% 降价,说明语音等多模态模型的竞争已从“有没有”转向“用不用得起”,API 价格成为争夺开发者的直接手段。

编辑点评:今天的关键词是“落地”——安全评估找上了咨询巨头,语音模型打起了价格战,而 arXiv 上的两篇论文则在提醒我们,效率提升的背后可能藏着尚未被完全理解的推理行为。