AI 与科技日报:2026年10月02日
今日要点
- OpenAI 在 DevDay 2026 上发布超过 20 项更新,涵盖 GPT-6 Astra、ChatGPT、Codex、API 与安全工具,并推出名为 dots 的主动式助手。
- 阿里发布 Qwen Intelligence,面向 AI 手机提供全栈解决方案。
- 安全议题集中出现:Anthropic 点名智谱 GLM-5.3 的漏洞利用能力增强,DeepSeek 则被 OECD 观察站指出服务中断与内容安全问题。
- Google DeepMind 推出 SynthID Bio,尝试为 AI 生成的蛋白质加上水印。
新闻速览
OpenAI DevDay 2026 回顾
OpenAI 汇总了 DevDay 2026 的全部发布内容,涉及 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具,官方称共有 20 多项公告。
来源:OpenAI News
OpenAI 推出 dots
OpenAI 介绍 dots 为主动式助手,可在复杂项目与日常任务中持续推进工作,同时让用户保持控制权。
来源:OpenAI News
DeepSeek 面临服务中断与内容安全问题
据 OECD AI Policy Observatory 收录的信息,DeepSeek AI 在中国面临服务中断、内容安全失效以及有害输出等问题。
来源:Google News / OECD AI Policy Observatory
Anthropic 点名智谱 GLM-5.3
报道称 Anthropic 指出智谱 GLM-5.3 在漏洞利用能力上有所增强,而安全防护仍存在缺口。
来源:cnBeta.COM(经 Google News)
阿里发布 Qwen Intelligence
在云栖大会相关报道中,阿里巴巴发布 Qwen Intelligence,称其为 AI 手机提供全栈解决方案,涉及千问大模型与荣耀等关键词。
来源:新浪财经(经 Google News)
Google DeepMind 推出 SynthID Bio
DeepMind 发布 SynthID Bio,作为为 AI 生成蛋白质添加水印的概念验证,目标是在保留生物功能的同时实现标识。
来源:Google DeepMind
PrivMeSA:面向医疗的隐私感知自演化多智能体系统
论文提出 PrivMeSA,通过本地—远程 LLM 协作控制信息披露,并指出仅移除显式标识符不足以防止准标识符在多轮问诊与重复就诊中累积导致重识别。
来源:arXiv cs.AI
用生成式 LLM 与标签聚合分类新闻中的经济政策不确定性
研究采用弱监督思路,用生成式 LLM 通过提示生成合成标签,以更低成本、可扩展的方式判断文章是否讨论经济政策不确定性及其具体类型,并探索多标签与层级分类方法。
来源:arXiv cs.LG
从 CUDA 到 MLX:K-Search 将内核经验带到 Apple Silicon
BAIR 文章讨论如何把 CUDA 优化知识转化为架构原生的 MLX 策略,而非逐指令照搬,以应对硬件多样化与 AI 工作负载专用化的趋势。
来源:BAIR Research
Olmo-core 3:面向大型 MoE 的开放可扩展训练基础设施
Hugging Face 博客介绍 Olmo-core 3,定位为面向大型混合专家模型的开源、可扩展训练基础设施。
来源:Hugging Face
MindTopo 揭示 VLM 的空间推理能力
Microsoft Research 发布 MindTopo,作为测试 AI 理解拓扑关系的新基准,并指出增强空间推理与规划的新机会。
来源:Microsoft Research
趋势判断
今天的消息呈现出两条并行主线。一条是能力与产品继续加速:OpenAI 一次性抛出 20 多项更新并推出 dots,阿里把大模型能力打包进 AI 手机全栈方案,说明厂商正从“模型发布”转向“入口与工作流”的争夺。另一条是安全与治理压力同步上升:DeepSeek 的服务与内容安全问题、Anthropic 对 GLM-5.3 漏洞利用能力的点名,以及 PrivMeSA 对医疗场景重识别风险的提醒,都指向同一个现实——能力越强,披露控制、内容安全与防护缺口就越难被忽略。与此同时,SynthID Bio、MindTopo、Olmo-core 3 与 K-Search 这类工作显示,研究侧正在补足“可验证、可评测、可迁移”的基础设施,这或许比单点能力提升更决定下一阶段的落地速度。
—
编辑点评:DevDay 的密集发布与安全议题的集中出现,恰好构成同一天的两面。能力扩张不会自动带来信任,谁能先把安全与评测做成产品的一部分,谁才更可能守住下一轮入口。