MyBlog

AI 与科技日报|2026-09-23

AI 与科技日报|2026年09月23日

今日要点

  • OpenAI 公布 GPT‑6 Astra 在 Parallel 的落地案例,称研究时间与成本双双减半。
  • Anthropic 发布 Claude Opus 5.5,官方信息经 Mashable 报道。
  • 阿里在云栖大会推出 Qwen Intelligence,主打 AI 手机全栈解决方案。
  • DeepSeek 相关动向密集:传其将就 AI 风险向联合国安理会作简报,并被美媒报道押注华为芯片训练大模型。
  • 学术侧关注长上下文推理效率与微调后的安全漂移问题;OpenAI 与 Hugging Face 分别就第三方评估、基准可复现性发声。

新闻速览

OpenAI:Parallel 借助 GPT‑6 Astra 将研究时间与成本减半
据 OpenAI 介绍,GPT‑6 Astra 让 Parallel 的智能体在研究与综合劳动力市场数据时,相比此前模型将时间与成本各压缩一半。
来源:OpenAI News

Anthropic 发布 Claude Opus 5.5
Mashable 报道称 Anthropic 推出 Claude Opus 5.5,内容涉及基准测试、定价与安全。具体数据以原文为准。
来源:Anthropic News / Mashable

消息称 DeepSeek 等公司将就 AI 风险向联合国安理会作简报
cnBeta 援引消息称,DeepSeek 等公司将就 AI 风险向联合国安理会作简报。
来源:DeepSeek News / cnBeta.COM

阿里发布 Qwen Intelligence,提供 AI 手机全栈解决方案
新浪财经报道,阿里在云栖大会发布 Qwen Intelligence,面向 AI 手机提供全栈解决方案,报道中提及荣耀及荣耀 Robot Phone。
来源:Qwen / 通义千问 News / 新浪财经

arXiv:RBS-Attention 提出长上下文稀疏预填充方法
论文针对长上下文 LLM 推理中预填充阶段的瓶颈,指出稀疏块选择存在“均值稀释”问题,提出免训练的 RBS-Attention,用质心基分支与救援分支互补选择。
来源:arXiv cs.AI

arXiv:SafeTune 统一微调 LLM 安全漂移的审计与修复
论文提出 SafeTune 库,整合事后权重恢复、安全约束微调、基于梯度的遗忘与推理时引导四种干预范式,并提供共享的可解释性、评估与部署工具。
来源:arXiv cs.LG

Hugging Face:英国 AISI 与 EvalEval 推动基准结果可复现
Hugging Face 博客介绍英国 AISI 与 EvalEval 在基准结果可复现性方面的工作。
来源:Hugging Face

OpenAI:提出有效第三方评估的优先事项与原则
OpenAI 阐述对前沿模型与防护措施开展严格、安全、独立第三方 AI 安全评估的优先事项与原则。
来源:OpenAI News

美媒:DeepSeek 押注华为芯片训练大模型
联合早报援引美媒报道称,DeepSeek 押注华为芯片训练大模型。
来源:DeepSeek News / 联合早报

趋势判断

今天的新闻呈现出两条并行的主线。一条是能力与效率:GPT‑6 Astra 的落地案例、Claude Opus 5.5 的发布,以及 RBS-Attention 这类针对长上下文推理成本的学术工作,都指向“用更少算力做更多事”的竞争。另一条是治理与安全:DeepSeek 被传将向联合国安理会作简报、OpenAI 谈第三方评估原则、SafeTune 试图统一安全漂移的修复流程、AISI 与 EvalEval 推动基准可复现,说明安全议题正从原则宣示走向可操作的工具与流程。此外,阿里 Qwen Intelligence 与 DeepSeek 押注华为芯片的报道,反映出国内厂商在端侧生态与算力自主上的同步推进。

—

编辑点评: 效率与安全这两条线正在同时收紧,前者决定谁能跑得更快,后者决定谁能跑得更远。真正值得关注的,是那些把安全做成可复用工具、把评估做成可复现流程的动作。