AI 日报 | 2026-09-03
模型、Agent / AI coding、基础设施 / 芯片 / 算力、开源模型、中国 AI 生态与重大商业新闻。
AIAgentsCodingInfraChina AI今日概览
今天的主线是:前沿模型继续转向 coding / agent / knowledge work,开源和中国模型厂商在长上下文、agent benchmark 与 OpenAI-compatible API 上追赶;infra 侧竞争从 GPU 单点转向网络、互联与 token factory;资本继续押注 coding agent。
最重要 3–5 条
1. Anthropic 发布 Claude Fable 5.1 / Mythos 5.1
摘要:Anthropic 新闻页显示 9 月 1 日发布新一代模型,定位为 coding 与 knowledge work 的最强模型,并强调研究能力是 AI 参与科学进展的早期信号。
为什么重要:这说明 Anthropic 继续把旗舰模型叙事压在“长程代理 + 专业知识工作”上,竞争焦点不是单轮聊天,而是可持续执行、代码库理解和企业场景可靠性。
2. Google DeepMind 9 月模型线更新:Gemini / Omni / Nano Banana / Genie 3 / Robotics
摘要:DeepMind 新闻和模型页在 9 月模型栏目突出 Gemini agent building、Gemini Omni、Nano Banana 图像生成/编辑、Gemini Audio、Veo/Imagen/Lyria、Genie 3 world model 与 Gemini Robotics。
为什么重要:Google 正把模型组合拆成“通用 agent + 生成媒体 + 世界模型/机器人 + open models”,强调跨模态工具链和物理世界推理,而不只是单一文本模型。
3. DeepSeek V4 系列最近更新仍值得跟踪:V4-Flash-Vision-Exp 与 V4-Pro GA
摘要:DeepSeek 8 月 21 日上线 deepseek-v4-flash-vision-exp,给出 Terminal Bench 2.1 83.9、NL2Repo 57.7、DeepSWE 59.3、Chartography 64.3 等;8 月 13 日 V4-Pro GA,HLE w/tools 60.0、Terminal Bench 2.1 87.9、DeepSWE 62.7,并原生支持 OpenAI Responses API、适配 Codex,thinking effort 支持 low/high/max。
为什么重要:这是中国模型厂商在 agent benchmark、视觉理解 agent、OpenAI-compatible API 和 coding workflow 上的直接追赶,尤其 Responses API 兼容会降低从 Codex/通用 agent harness 迁移成本。
4. 智谱 Z.ai 强调 GLM-5.2 开源、1M context 与 agent/coding;AutoClaw 暗示 GLM 5.3 体验
摘要:Z.ai 官网将 GLM-5.2 描述为 frontier intelligence/open weights,强调 coding、agentic tasks、1M-token lossless context 与长程任务执行;AutoClaw 页面出现“GLM 5.3 抢先体验”。
为什么重要:智谱路线非常明确:把开源权重、长上下文、coding agent serving 和桌面 agent 产品绑定,竞争对象从聊天机器人转向“每台 PC 上的 agent 工作伙伴”。
5. llama.cpp 继续高频预发布,GitHub releases 显示 9 月 2 日 b10766
摘要:ggml-org/llama.cpp releases 页面显示 9 月 2 日 b10766 pre-release;该项目约 127k stars,持续快速迭代本地和边缘 LLM/VLM 推理。
为什么重要:在模型频繁发布、量化格式和消费级硬件部署持续变化的环境里,llama.cpp 仍是开源推理生态的底层风向标。
其他值得关注
6. NVIDIA 在 Hot Chips 2026 强调从芯片到网络再到 token factory 的系统协同;并与 MediaTek/NVLink Fusion 生态扩展相关
摘要:NVIDIA 站点摘要称 Hot Chips 2026 展示“from chips to networks to the token factory”的 extreme codesign;媒体报道提到 9 月 1 日附近 NVIDIA 对 MediaTek 的 35 亿美元投资及 NVLink Fusion 采用。
为什么重要:AI infra 竞争正在从单卡性能转向网络、互联、机柜级/数据中心级 co-design 与 hyperscaler 定制芯片生态,NVLink Fusion 是 NVIDIA 把自研 ASIC 纳入其数据中心互联版图的抓手。
7. 商业侧:Cognition 据报拟融资约 10 亿美元、估值约 470 亿美元
摘要:Bloomberg 9 月 2 日报道称 AI coding startup Cognition AI 将完成约 10 亿美元融资,估值约 470 亿美元。
为什么重要:资本市场继续把 coding agent 视为最接近商业闭环的 AI 应用层赛道;高估值也会加剧 Claude Code、Codex、Copilot、Cursor、Devin/Cognition 等之间的人才、算力和企业客户争夺。
- MiniMax:MiniMax 新闻页继续主推 M3、H3、Speech 2.8、Music 3.0、MiniMax Code/Design,7 月 H3 open 多模态方向仍是近期主线。 来源
- Baidu ERNIE:ERNIE 官方站显示 ERNIE 5.1 已发布并强调以较低预训练成本取得多榜领先,但近 24–48 小时未发现更强官方新发布。 来源
- Cloudflare Workers AI:Workers AI 继续定位为边缘 AI inference,一次 API 调用、OpenAI SDK 兼容、免 GPU 容量管理;近 24–48 小时未检索到重大官方模型更新。 来源
- OpenAI:检索到 OpenAI release notes/API changelog 入口,但本轮未确认近 24–48 小时重大官方模型发布;需继续监控 Codex 与 Responses API 变动。 来源