MyBlog

AI 与科技日报|2026-09-08

AI 日报 2026年09月08日

今日要点

  • OpenAI 首席科学家反思 AI 对齐挑战,呼吁加强安全护栏与国际协作
  • Anthropic 在美国最严苛 AI 安全法案上与 OpenAI、Google 立场分裂
  • 第五届全球数贸会杭州开幕,DeepSeek 等 200 余个大模型集中亮相
  • 智谱 AI 入驻天猫开设官方旗舰店,大模型套餐可直接网购
  • Google DeepMind 宣布与多家游戏工作室合作,推进 AI 游戏研究

新闻速览

1. OpenAI:越来越像“外星心智”的 AI,如何保持对齐?

OpenAI 研究员 Jakub Pachocki 撰文反思日益强大的 AI 系统所带来的对齐难题。他明确指出,随着模型能力持续跃升,确保其行为符合人类意图的挑战也在加剧,并呼吁业界建立更强的安全防护措施,同时加强国际间的协调与合作。

阅读原文

2. Anthropic 与 OpenAI、Google 在美国最严 AI 安全法案上决裂

据 WION 报道,在针对美国一项被称为“最严苛”的 AI 安全法案的立场上,Anthropic 选择了与 OpenAI 和 Google 截然不同的道路。这一分裂凸显了主要 AI 实验室在监管路径上的深刻分歧。

阅读原文

3. 第五届全球数贸会杭州开幕:200 多个人工智能大模型集中亮相

第五届全球数字贸易博览会将在杭州开幕。据报道,包括 DeepSeek 在内的 200 多个人工智能大模型将在此次展会上集中亮相,展示中国大模型生态的最新进展。

阅读原文

4. 智谱 AI 入驻天猫开设官方旗舰店,大模型套餐可直接网购

据 TradingView 报道,智谱 AI 已正式入驻天猫平台并开设官方旗舰店。这意味着用户现在可以直接通过电商渠道购买其大模型相关套餐服务,标志着 AI 服务在消费市场的渠道拓展进入新阶段。

阅读原文

5. 菲尔兹奖得主入局大模型:4B 手机 Qwen + 云端 GLM 刷爆 ARC-AGI 3

据 Sohu 报道,在最新的 ARC-AGI 3 基准测试中,由 4B 参数的手机端 Qwen 模型与云端 GLM 模型组成的组合方案取得了突破性成绩。值得注意的是,一位菲尔兹奖得主也参与其中,为这一成果增添了更多关注度。

阅读原文

6. Google DeepMind:从《Atari》到《EVE Online》,15 年游戏 AI 研究之路

Google DeepMind 发布博客,回顾其在游戏 AI 领域 15 年的研究历程。文章宣布,DeepMind 正与多家游戏工作室合作,共同开发突破性的 AI 游戏玩法原型,将研究成果进一步推向产业应用。

阅读原文

7. arXiv 论文:从匹配模型到招聘智能体——AI 招聘系统综述

一篇发表于 arXiv 的综述论文(编号 2609.04286)系统梳理了 AI 在招聘领域的演变。研究指出,自动化对象已从简历配对和排序,转向涵盖证据检索、候选人比较乃至执行动作的多阶段工作流,并分析了从神经人岗匹配到 LLM 组件及工具型招聘智能体的发展路径。

阅读原文

8. arXiv 论文:评估大语言模型在停电风险预测中的表现

另一篇 arXiv 论文(编号 2609.04272)探讨了在零样本框架下,使用大语言模型预测天气相关停电风险的能力。研究基于德克萨斯州中部某公用事业区域六年的停电记录和气象数据,对比了四种零样本 LLM 与两种监督学习模型的表现。结果显示,监督模型在宏 F1 分数和精确率上仍占优,但新一代 LLM 已取得有竞争力的成绩。

阅读原文

9. OpenAI 支持乌克兰独立新闻业

OpenAI 宣布与 AIRPPU 及 WAN-IFRA 合作,启动一项 AI 计划,旨在帮助乌克兰新闻机构增强创新能力、韧性,并支持其独立新闻报道工作。

阅读原文

10. 英伟达黄仁勋称 GPT-6 Astra 预示 AGI 时代,但 Anthropic Fable 5.1 在编码基准上仍胜出

据 Wccftech 报道,英伟达 CEO 黄仁勋评价 OpenAI 耗资约 10 亿美元的 GPT-6 Astra 项目,称其预示着 AGI 时代的到来。然而,报道同时指出,Anthropic 的 Fable 5.1 模型在 SWE-Bench Pro 和编码基准测试上依然击败了 GPT-6。

阅读原文

11. 办公 Agent 用户画像:北上广深杭占 27%,DeepSeek V4 Flash 调用量领先

据新浪财经报道,一份关于办公 Agent 的市场报告显示,来自北上广深杭五个城市的用户占比达到 27%。在模型调用方面,DeepSeek V4 Flash 的调用量占据了“半壁江山”,显示出其在办公场景中的强劲需求。

阅读原文

趋势判断

从今日新闻来看,AI 行业正呈现出几个显著趋势:安全与治理分歧加剧(Anthropic 与 OpenAI/Google 的立场分裂)、模型能力竞争白热化(GPT-6 与 Fable 5.1 的基准对决)、商业化渠道下沉(智谱 AI 上天猫、办公 Agent 普及),以及AI 在垂直领域的深化应用(招聘、电网预测、游戏研发)。前沿模型在追求 AGI 的同时,如何平衡安全、成本与落地效率,将成为下一阶段的核心议题。

—

编辑点评:今日新闻呈现了 AI 行业“冰火两重天”的图景——一边是动辄十亿美元投入的 AGI 竞赛,另一边是大模型套餐上网购的消费级普及。安全分歧与能力跃升并存,提醒我们在追逐“外星心智”的同时,勿忘对齐人类价值的根本命题。