1
OpenAI:Codex 继续向“全软件工程工作流”靠近
摘要:OpenAI 的 Codex 更新把重点从单点代码补全推进到更完整的工程工作流:迁移 Cursor/Claude Code 配置、MCP servers、plugins、sessions、commands 与 project-scoped memories 等能力,意味着 coding agent 的竞争焦点正在从模型能力扩展到“上下文资产与工具链可携带性”。
为什么重要:对企业工程团队而言,agent 的锁定点不再只是 IDE,而是权限、记忆、工具服务器、会话与审计;谁能稳定承接这些状态,谁更可能成为默认软件交付入口。
来源链接
2
GitHub Copilot:使用指标与安全审查继续企业化
摘要:GitHub Changelog 在 7 月下旬更新 Copilot usage metrics 影响说明;此前 Copilot app 增加 /security-review,可直接对进行中的代码变更跑安全审查。7 月还把 OpenAI GPT-5.6 Sol/Terra/Luna 与 Kimi K2.7 Code 纳入 Copilot 模型选择。
为什么重要:Copilot 的核心变化是“治理层”增强:使用量、模型池、代码安全 review 被产品化,方便企业把 AI coding 从个人效率工具纳入工程管理与安全流程。
来源链接
3
中国模型生态:DeepSeek API 旧模型名临近退役,Kimi/Qwen/GLM 持续推 agent 与 coding
摘要:DeepSeek API 文档提示 deepseek-chat 与 deepseek-reasoner 将于 2026-07-24 15:59 UTC 停用;Moonshot 官网与开放平台继续突出 Kimi K3、1M token 上下文、Tool Calling 与代码能力;Qwen 近期围绕 Qwen Code 的 /loop、子 agent、MCP approval gate 等持续迭代;Z.ai 6 月发布 GLM-5.2,定位 long-horizon tasks。
为什么重要:中国大模型正在从“参数/榜单发布”转向“agentic 工程栈”:长上下文、tool calling、coding plan、可持久运行的 agent loop 和治理能力成为差异化主线。
来源链接
4
Cloudflare Agents Week:边缘云继续补 agent 运行时、工具与安全
摘要:Cloudflare 汇总 Agents Week 2026 发布,覆盖 agents-sdk、Workers AI structured outputs/tool calling/longer context、AI Gateway 与 agentic web 相关能力。Cloudflare 把 serverless、网关、身份/安全与推理层组合成 agentic cloud。
为什么重要:Agent 进入生产后,瓶颈不只是模型调用,而是低延迟工具执行、流量观测、权限边界、成本控制与多区域部署;Cloudflare 试图把这些平台能力封装到边缘运行时。
来源链接
5
推理基础设施:llama.cpp 高频 release 与 MiniMax API 价格调整提醒
摘要:ggml-org/llama.cpp 在 GitHub 继续高频发布,搜索结果显示最近 release 距今约 11 小时;MiniMax API 文档显示 API-vlm 价格更新将于 2026-07-22 生效。开源本地推理与商业 API 的价格/能力曲线仍在快速重定价。
为什么重要:推理栈的竞争正在进入“单位 token 成本 + 本地可部署性 + 多模态吞吐”的组合战。llama.cpp 等本地推理框架的节奏会直接影响边缘设备、私有化部署和成本敏感型 agent。
来源链接
6
算力与商业:NVIDIA/AI cloud 投资与中美供应链仍是主线
摘要:Reuters 近期报道 NVIDIA 投资 AI cloud 公司 Nebius,并持续跟踪中国 AI 企业获取 H200、DeepSeek 自研芯片等议题;7 月 22 日 Reuters 还从 OpenAI/Hugging Face 安全事件切入讨论中美 AI 竞赛。
为什么重要:算力供给、GPU 获取路径、自研 inference chip 与云资本开支,仍决定模型迭代速度和 API 价格下限;商业新闻需要和技术路线一起看。
来源链接