2026-09-05 · Beijing 06:30

AI 日报 | 2026-09-05

聚焦最近 24–48 小时模型、Agent/AI coding、基础设施/算力、中国 AI 生态与商业动态。

ModelsAgentsAI CodingInfraChina AI

今日概览

过去两天的主线是:前沿模型继续向 agentic computer-use 与 coding 场景集中;Copilot 等开发者平台开始把模型选择、代码审查和批准纳入同一闭环;基础设施侧继续大规模押注 GPU 供给;中国模型公司则围绕低价 API、长上下文、coding/agent 产品与多模态开源栈持续迭代。

最重要 5 条

1. OpenAI 发布 GPT-6 Astra,并同步披露安全评估

摘要:GPT-6 Astra 被定位为更强的 computer-use / agentic model,面向表单填写、CRM 更新、日程组织等高摩擦任务;OpenAI 同步发布安全概览,称 Astra 在对齐与网络安全能力上较 GPT-5.6 Sol 有显著变化。

关键细节 / 为什么重要:Astra 的重点不是单轮聊天,而是将“可操作任务”推向默认工作流;与此同时,OpenAI 主动强调 cyber capability threshold,说明前沿模型发布越来越依赖能力分级、运行时护栏与客户分层访问。

2. GitHub Copilot 接入 Claude Fable 5.1,代码审查开始给出可批准判断

摘要:GitHub Changelog 显示 Claude Fable 5.1 已面向 Copilot Pro+、Max、Business、Enterprise 开放,可在 VS Code 等模型选择器中使用;同日 Copilot code review 增加 approval assessment。

关键细节 / 为什么重要:AI coding 的竞争正在从“补全/聊天”转为“审查、批准、执行”的软件工程闭环。Fable 5.1 进入 Copilot 也意味着企业开发者会在同一 IDE 内直接比较 OpenAI、Anthropic 等模型的 agentic coding 表现。

3. AWS 与 NVIDIA 扩大 AI 基础设施合作:规划额外 200 万块 GPU

摘要:NVIDIA Newsroom 称 AWS 与 NVIDIA 将部署 200 万块额外 NVIDIA GPU,并在 AI factories、CPU、networking、open models、data processing、robotics 等方向深化协作。

关键细节 / 为什么重要:这是一条算力供给侧的硬信号:即使 hyperscaler 自研芯片加速,NVIDIA GPU 仍是近期 agentic/physical AI 扩容的主干。对模型公司和企业客户而言,供给、地域、网络与调度能力会继续决定训练和推理成本曲线。

4. 中国模型生态:DeepSeek V4-Pro GA 后进入 API/价格稳定期,Qwen/GLM/豆包/MiniMax 继续围绕 coding、agent、长上下文推进

摘要:DeepSeek API 更新页显示 V4-Pro 已 GA,并引入 peak/off-peak 价格;智谱页面出现 GLM-5.3 与 AutoClaw/AutoGLM agent 产品线;火山方舟模型广场展示 Doubao-Seed-2.1 面向 Coding 和 Agent;MiniMax 文档/博客继续强调 M2.5/M3、H3、多模态与工具调用。

关键细节 / 为什么重要:中国生态的主线不是单一“最强模型”新闻,而是开源/低价 API/agent 产品化的组合拳。对企业采用者,价格、上下文长度、代码与工具调用能力、国产云可得性,比排行榜单点排名更关键。

5. vLLM 推进 MiniMax H3 生产化服务,开源推理栈继续向多模态/视频生成扩展

摘要:vLLM 博客发布 MiniMax H3 on vLLM-Omni,介绍完整 H3 stack 优化与 FastVideo 四步 FastH3 集成;vLLM release 页面显示 8 月底 v0.28.0。

关键细节 / 为什么重要:开源推理框架正在从 LLM serving 扩展到 omni/multimodal serving。随着模型侧上下文和模态复杂度提高,调度、KV cache、批处理、视频生成吞吐会成为平台差异化。

其他值得关注