AI 与科技日报|2026年09月11日
> 政策、人才流动与模型评测同日升温:AI 安全议题正从实验室走向监管议程,而企业侧的数据与硬件落地仍在加速。
今日要点
- OpenAI 呼吁在政策窗口期内推动更强的安全证据与共享标准。
- 两名 AI 研究人员因安全担忧离开 Anthropic 与 Google,美国国会议员随后呼吁制定新的 AI 规则。
- 美国 NSA、CISA、FBI 联合指控 DeepSeek 等六家中国 AI 公司”工业规模蒸馏”美国大模型。
- 千问新款 AI 眼镜现身外滩大会,或加入虹膜支付能力。
- arXiv 同日收录两项研究:LLM 驱动的系统性文献综述基准 SciLitBench,以及 LLM 生成 SystemVerilog 断言在语义保持变换下的鲁棒性评估。
- OpenAI 在 ChatGPT Work 中推出 Data agent,支持用自然语言连接企业数据并构建交互式仪表盘。
新闻速览
OpenAI:AI 政策窗口仍然敞开
Chris Lehane 撰文主张,更强的 AI 能力需要更强的安全证据、共享标准与持久的政策行动,并强调应趁政策窗口仍开放时采取行动。
来源:OpenAI News
两名 AI 研究人员因安全担忧离职
据 NBC News 报道,两名 AI 研究人员因安全担忧离开 Anthropic 与 Google,报道引述其说法称”房间里没有成年人”。
来源:nbcnews.com
美国议员呼吁制定新 AI 规则
在 Anthropic 研究人员发出安全警告后,美国国会议员呼吁出台新的 AI 规则。
来源:reuters.com
美国三机构联合指控六家中国 AI 公司
美国 NSA、CISA、FBI 联合指控 DeepSeek 等六家中国 AI 公司实施”工业规模蒸馏”美国大模型。
来源:eet-china.com
千问新款 AI 眼镜亮相外滩大会
千问新款 AI 眼镜现身外滩大会,报道称其或加入虹膜支付能力。
来源:finance.sina.cn
SciLitBench:LLM 系统性文献综述基准
该研究提出覆盖标题与摘要筛选、全文筛选、模式引导数据抽取的多阶段基准,包含 42,981 条检索记录、1,012 篇全文与 888 篇纳入论文的标注;在来自六个模型家族的 22 个开放权重 LLM 上,明确的纳入与排除标准使标题与摘要筛选的 F₂ 提升 28.8%,研究者撰写的理由使全文筛选提升 15%。
来源:arXiv:2609.05505
LLM 生成 SystemVerilog 断言的鲁棒性评估
该论文对 LLM 生成 SVA 在语义保持的 RTL 变换下进行受控蜕变评估,基于 VERT 数据集构建评估集,包含 295 个赋值行为,并评测 Qwen2.5-Coder-7B 与 DeepSeek-Coder-V2-Lite。
来源:arXiv:2609.05658
OpenAI 推出 ChatGPT Work 中的 Data agent
该功能支持连接企业数据、发现洞察,并用自然语言构建交互式仪表盘。
来源:OpenAI News
趋势判断
安全议题正在从内部争论外溢为公共政策压力:研究人员的离职与国会层面的规则呼声形成呼应,而 OpenAI 主动呼吁安全证据与共享标准,说明头部实验室也在争取规则制定的话语权。与此同时,围绕模型训练来源的跨境指控升级,可能进一步加剧中美 AI 生态的合规摩擦。技术侧则呈现两条并行线索——企业数据智能加速产品化,而学术评测开始从单点正确率转向多阶段、抗扰动的可靠性衡量。
—
编辑点评:安全争论与监管动作在同一天密集出现,说明行业已难以把治理问题留给”以后再说”。当政策窗口、人才流动与跨境指控同时发生,真正稀缺的不是模型能力,而是可信的验证机制与共识。