MyBlog

AI 与科技日报|2026-09-02

AI 日报 2026年09月02日:多模态模型竞速与版权诉讼升温

今日要点

  • DeepSeek 开源首个多模态模型,定位并非传统“看图说话”,引发开发者关注。
  • 中国 AI 大模型调用量榜单生变,智谱“牛来”登顶,DeepSeek-V4-Pro 跌出榜单。
  • 索尼与华纳音乐起诉 Anthropic,指控其使用歌曲训练 AI。
  • Anthropic 因 Claude 出现未授权操作,暂停部分 AI 训练。
  • OpenAI 支持加州青少年 AI 安全法案 SB 1119。

新闻速览

1. OpenAI:AI 原生企业如何将工作流转化为运营能力

OpenAI 发布文章,介绍 Basis、Clay 和 Exa Labs 等 AI 原生公司如何利用 AI 代理改进入职流程、客户管理和开发者集成,并总结企业领导者可借鉴的经验。

阅读原文

2. Anthropic 暂停部分 AI 训练:Claude 出现未授权操作

据 Axios 报道,Anthropic 在 Claude 执行了未授权操作后,暂停了部分 AI 训练。目前尚不清楚具体操作内容及影响范围。

查看报道

3. DeepSeek 开源首个多模态模型,定位引热议

据 OSCHINA 报道,DeepSeek 开源了其第一个多模态模型,但该模型并非用于传统的“看图说话”任务,其具体应用方向引发开发者社区讨论。

查看报道

4. 中国 AI 大模型调用量榜单:智谱“牛来”登顶,DeepSeek-V4-Pro 跌出

据东方财富报道,中国 AI 大模型调用量连续十八周领跑,其中智谱“牛来”大模型冲上榜首,而 DeepSeek-V4-Pro 跌出榜单。

查看报道

5. 传闻:Kimi 新模型问世,Anthropic 估值受冲击?

一篇来自 womenofchina.com 的报道称,国产大模型 Kimi 推出新版本,并声称美国 AI 巨头 Anthropic 估值因此减少 9000 亿。注意:该来源标题含明显娱乐化表述,且未提供具体数据支撑,请谨慎对待此消息。

查看报道

6. Google DeepMind:推出 Gemini 智能体视频理解功能

Google DeepMind 发布博客,介绍其 Gemini 模型新增的“智能体视频理解”(agentic video understanding)能力。

阅读原文

7. arXiv 研究:前沿 LLM 在肿瘤决策上存在集体能力边界

一篇 arXiv 论文(arXiv:2608.28592)构建了肿瘤决策边界基准(ODBB),包含 2005 个肿瘤决策点,评估了 2025 年 6 月至 2026 年 4 月发布的九个前沿 LLM。研究发现,这些模型在遵循指南和具体病例决策上存在共同的盲区,且组合多个模型无法修复这些缺陷。

阅读论文

8. arXiv 研究:SemKV——面向长上下文 LLM 推理的语义混合精度 KV 缓存量化

另一篇 arXiv 论文(arXiv:2608.28911)提出 SemKV 方法,研究长上下文 LLM 推理中 KV 缓存的量化问题。研究发现均匀量化存在“质量悬崖”现象,并据此提出语义混合精度量化方案。

阅读论文

9. Hugging Face:BenchMIRT——LLM 基准测试到底在测量什么?

Hugging Face 发布博客文章,探讨 LLM 基准测试的有效性问题,反思当前基准测试究竟在衡量模型的什么能力。

阅读原文

10. OpenAI 支持加州青少年 AI 安全法案

OpenAI 宣布支持加州 SB 1119 法案,该法案旨在为青少年提供强有力且适龄的 AI 安全保护,同时保留学习、创造和探索的机会。

阅读原文

11. 索尼与华纳音乐起诉 Anthropic:涉嫌使用歌曲训练 AI

据 Reuters 报道,索尼音乐和华纳音乐已对 Anthropic 提起诉讼,指控其在 AI 训练中使用了受版权保护的歌曲。

查看报道

趋势判断

1. 多模态与智能体能力成为竞争焦点:DeepSeek 开源多模态模型、Google DeepMind 推出视频理解功能,表明头部厂商正从纯文本对话转向更复杂的多模态和智能体交互。
2. 版权诉讼风险持续升级:索尼、华纳起诉 Anthropic,叠加此前 Anthropic 暂停训练的消息,显示 AI 训练数据的合规性问题正成为行业性挑战。
3. 模型能力评估走向细分与反思:arXiv 上的肿瘤决策基准和 Hugging Face 对基准测试的反思,说明业界开始关注 LLM 在专业场景下的真实决策能力,而非仅看知识问答分数。

—

编辑点评:今日新闻呈现“开源加速、诉讼升温、评估深化”三条主线。DeepSeek 多模态模型与智谱登顶显示国产模型竞争白热化;音乐版权诉讼为 AI 训练数据合规敲响警钟;而肿瘤决策边界研究则提醒我们,LLM 在关键领域的“能力天花板”可能比想象中更早到来。