MyBlog

AI 与科技日报|2026-09-15

AI 与科技日报|2026年09月15日

今日要点

  • OpenAI 连发两条产品动态:一边是 Fyxer 基于其模型打造的 AI 行政助理案例,一边是面向金融服务场景的 ChatGPT 专用版本。
  • 大模型调用量榜单出现明显变动:DeepSeek V4.1 Flash 上线三天升至第六,智谱 GLM 5.3、MiniMax M3 跌出榜单,中国大模型调用量据报连续二十周领跑。
  • Anthropic 联合创始人就 AI 安全议题发声,将中美竞争与”掷骰子”式监管风险挂钩。
  • 学术侧,一篇 arXiv 论文探讨代码大模型的离线后训练,关注性能、效率与”坍塌”问题。

新闻速览

OpenAI:Fyxer 用其模型打造可信 AI 行政助理
据 OpenAI 官方介绍,Fyxer 结合 OpenAI 模型、微调、记忆机制与真实用户反馈,帮助用户整理收件箱,并以每位用户自己的语气起草邮件。
来源:OpenAI News

OpenAI 推出面向金融服务场景的 ChatGPT
OpenAI 发布 ChatGPT for Financial Services,称其整合内置金融数据与 GPT-6 Astra,用于研究、建模以及面向客户的材料准备。
来源:OpenAI News

Anthropic 联合创始人谈 AI 安全与中美竞争
据 Fox News 报道,Anthropic 联合创始人表示,若在 AI 安全问题上”掷骰子”,美国将在与中国的竞争中落败。
来源:Anthropic News / Fox News

大模型周调用榜:DeepSeek V4.1 Flash 快速上位
多家媒体报道称,DeepSeek V4.1 Flash 上线三天即升至全球 AI 大模型每周 Token 调用榜第六位,智谱 GLM 5.3 与 MiniMax M3 跌出榜单。
来源:Sohu|新浪财经|每日经济新闻

中国大模型调用量据报连续二十周领跑
同一组报道指出,中国 AI 大模型调用量已连续二十周位居全球前列,DeepSeek V4.1 Flash 的快速攀升是本期榜单的主要变化。
来源:Sohu

Kimi 相关动态:智能体商业与支付话题
据新浪财经报道,Kimi、BAI、自然选择围绕智能体新商业展开讨论,提出”AI 支付增量来自硅基生命的支付”这一观点。
来源:新浪财经

另有报道称 Anthropic 估值受冲击
有媒体以”国产大模型 Kimi 贵宾厅的网站问世 美国 AI 巨头 Anthropic 被冲击:估值少了 9000 亿”为题进行报道。该标题表述较为夸张,具体数据与口径需以原始报道为准。
来源:体坛

arXiv:代码大模型的离线后训练研究
论文《Performance, Efficiency and Collapse — Advantages and Challenges in Offline Post-training of Code LLMs》探讨能否完全离线地完成基于强化学习的后训练,而非在线生成新样本。摘要称,仅数小时训练即可显著提升零样本代码生成表现,但同时也涉及效率与”坍塌”等挑战。
来源:arXiv cs.LG

趋势判断

第一,应用层正在向垂直场景纵深。 OpenAI 同日出现 Fyxer 案例与金融服务专用版 ChatGPT,说明模型厂商正把能力封装进具体工作流,而非停留在通用对话。

第二,调用量榜单的洗牌速度在加快。 DeepSeek V4.1 Flash 三天进入前六、GLM 5.3 与 MiniMax M3 跌出榜单,反映出用户对模型的选择高度依赖版本迭代节奏,领先地位并不稳固。

第三,安全叙事与商业叙事并行。 一边是 Anthropic 联合创始人把 AI 安全与中美竞争直接绑定,一边是智能体支付等新商业话题升温,两条线索短期内会持续交织。

—

编辑点评: 今天的新闻里,产品落地与榜单洗牌是主线,安全争论是背景音。真正值得跟踪的不是单周排名,而是这些模型能否在垂直场景里留住用户。