Beijing · 2026-09-03 · 过去 24–48 小时

AI 日报 | 2026-09-03

模型、Agent / AI coding、基础设施 / 芯片 / 算力、开源模型、中国 AI 生态与重大商业新闻。

AIAgentsCodingInfraChina AI

今日概览

今天的主线是:前沿模型继续转向 coding / agent / knowledge work,开源和中国模型厂商在长上下文、agent benchmark 与 OpenAI-compatible API 上追赶;infra 侧竞争从 GPU 单点转向网络、互联与 token factory;资本继续押注 coding agent。

最重要 3–5 条

1. Anthropic 发布 Claude Fable 5.1 / Mythos 5.1

摘要:Anthropic 新闻页显示 9 月 1 日发布新一代模型,定位为 coding 与 knowledge work 的最强模型,并强调研究能力是 AI 参与科学进展的早期信号。

为什么重要:这说明 Anthropic 继续把旗舰模型叙事压在“长程代理 + 专业知识工作”上,竞争焦点不是单轮聊天,而是可持续执行、代码库理解和企业场景可靠性。

来源链接

2. Google DeepMind 9 月模型线更新:Gemini / Omni / Nano Banana / Genie 3 / Robotics

摘要:DeepMind 新闻和模型页在 9 月模型栏目突出 Gemini agent building、Gemini Omni、Nano Banana 图像生成/编辑、Gemini Audio、Veo/Imagen/Lyria、Genie 3 world model 与 Gemini Robotics。

为什么重要:Google 正把模型组合拆成“通用 agent + 生成媒体 + 世界模型/机器人 + open models”,强调跨模态工具链和物理世界推理,而不只是单一文本模型。

来源链接

3. DeepSeek V4 系列最近更新仍值得跟踪:V4-Flash-Vision-Exp 与 V4-Pro GA

摘要:DeepSeek 8 月 21 日上线 deepseek-v4-flash-vision-exp,给出 Terminal Bench 2.1 83.9、NL2Repo 57.7、DeepSWE 59.3、Chartography 64.3 等;8 月 13 日 V4-Pro GA,HLE w/tools 60.0、Terminal Bench 2.1 87.9、DeepSWE 62.7,并原生支持 OpenAI Responses API、适配 Codex,thinking effort 支持 low/high/max。

为什么重要:这是中国模型厂商在 agent benchmark、视觉理解 agent、OpenAI-compatible API 和 coding workflow 上的直接追赶,尤其 Responses API 兼容会降低从 Codex/通用 agent harness 迁移成本。

来源链接

4. 智谱 Z.ai 强调 GLM-5.2 开源、1M context 与 agent/coding;AutoClaw 暗示 GLM 5.3 体验

摘要:Z.ai 官网将 GLM-5.2 描述为 frontier intelligence/open weights,强调 coding、agentic tasks、1M-token lossless context 与长程任务执行;AutoClaw 页面出现“GLM 5.3 抢先体验”。

为什么重要:智谱路线非常明确:把开源权重、长上下文、coding agent serving 和桌面 agent 产品绑定,竞争对象从聊天机器人转向“每台 PC 上的 agent 工作伙伴”。

来源链接

5. llama.cpp 继续高频预发布,GitHub releases 显示 9 月 2 日 b10766

摘要:ggml-org/llama.cpp releases 页面显示 9 月 2 日 b10766 pre-release;该项目约 127k stars,持续快速迭代本地和边缘 LLM/VLM 推理。

为什么重要:在模型频繁发布、量化格式和消费级硬件部署持续变化的环境里,llama.cpp 仍是开源推理生态的底层风向标。

来源链接

其他值得关注

6. NVIDIA 在 Hot Chips 2026 强调从芯片到网络再到 token factory 的系统协同;并与 MediaTek/NVLink Fusion 生态扩展相关

摘要:NVIDIA 站点摘要称 Hot Chips 2026 展示“from chips to networks to the token factory”的 extreme codesign;媒体报道提到 9 月 1 日附近 NVIDIA 对 MediaTek 的 35 亿美元投资及 NVLink Fusion 采用。

为什么重要:AI infra 竞争正在从单卡性能转向网络、互联、机柜级/数据中心级 co-design 与 hyperscaler 定制芯片生态,NVLink Fusion 是 NVIDIA 把自研 ASIC 纳入其数据中心互联版图的抓手。

来源链接

7. 商业侧:Cognition 据报拟融资约 10 亿美元、估值约 470 亿美元

摘要:Bloomberg 9 月 2 日报道称 AI coding startup Cognition AI 将完成约 10 亿美元融资,估值约 470 亿美元。

为什么重要:资本市场继续把 coding agent 视为最接近商业闭环的 AI 应用层赛道;高估值也会加剧 Claude Code、Codex、Copilot、Cursor、Devin/Cognition 等之间的人才、算力和企业客户争夺。

来源链接

来源清单

核心来源 / 条目数量:7。优先官方页面与 GitHub;商业融资采用 Bloomberg 检索结果。