GLM-5.2 全量开放,ZCode 3.0 上线
智谱全量开放 GLM-5.2,该模型支持 1M 上下文并在长程任务中保持领先。ZCode 3.0 围绕 GLM-5.2 深度优化,推出自研 Agent 以提升智能编码体验,并为 Coding Plan 订阅用户和新人提供配额权益。
推荐理由:原文明确了 GLM-5.2 的 1M 上下文能力和 ZCode 3.0 的深度优化,为开发者评估智能编码工具提供了具体参考。
技术方向
让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。
74 条精选近 30 天 34 条共收录 279 条
智谱全量开放 GLM-5.2,该模型支持 1M 上下文并在长程任务中保持领先。ZCode 3.0 围绕 GLM-5.2 深度优化,推出自研 Agent 以提升智能编码体验,并为 Coding Plan 订阅用户和新人提供配额权益。
推荐理由:原文明确了 GLM-5.2 的 1M 上下文能力和 ZCode 3.0 的深度优化,为开发者评估智能编码工具提供了具体参考。
DeepSeek-V4 预览版模型正式上线并同步开源,包含 DeepSeek-V4-Pro 和 DeepSeek-V4-Flash 两个版本。即日起登录官网或官方 App 即可使用 1M 超长上下文,API 服务同步更新,需将 model_name 修改为 deepseek-v4-pro 或 deepseek-v4-flash。
推荐理由:预览版模型同步开源,给出了 API 调用入口和 1M 上下文标配说明,读者可以据此判断它在 Agent 场景中的具体部署方式。
OpenAI 更新了适用于 macOS 和 Windows 的 Codex 应用,新增电脑操作、应用内浏览、图像生成、记忆和插件功能,以加速开发者工作流。
推荐理由:介绍了 Codex 在 macOS 和 Windows 应用上新增的电脑操作、应用内浏览、图像生成、记忆和插件功能,便于开发者评估其工作流变化。
Meta 发布的 Muse Spark 模型现已在 Meta AI App 和 meta.ai 中上线,核心特性是支持并行启动多个 Subagents 处理任务。该模型专为多模态感知设计,后续将集成至 Facebook、Instagram、WhatsApp 及 Meta 眼镜等全产品线。
推荐理由:原文拆解了 Muse Spark 如何将 Subagents 作为核心功能嵌入 Meta 核心应用,揭示了其争夺日常助手入口的深层战略意图。
OpenAI 更新了 Agents SDK,新增原生沙箱执行和模型原生 harness 功能。这些更新有助于开发者构建跨文件和工具的更安全、可长期运行的 AI 智能体。
推荐理由:官方明确了 Agents SDK 的新增机制,给出了安全执行与长时运行场景的落地路径。
Andrej Karpathy 分享了一份关于使用 LLM 构建和维护个人知识库的改进版理念文件(idea file)。他认为在 LLM 智能体时代,分享具体代码不如分享核心理念,由用户的智能体根据自身需求定制和构建。该理念包括使用 Obsidian 作为界面,LLM 自动编译 Markdown 维基,处理问答、数据清理,并探索合成数据生成。
推荐理由:作者分享了利用LLM构建和维护个人知识库的方法,提供了抽象化的理念清单,读者可据此定制自己的智能体工作流。
Andrej Karpathy 分享了利用 LLM 构建和维护个人 Markdown 知识库的方法,将 LLM 主要用于知识操作而非代码编写。其工作流包括将源文档索引到 raw 目录,由 LLM 增量编译生成包含摘要和反向链接的 Wiki。
推荐理由:作者展示了利用 LLM 自动编译和维护 Markdown 知识库的具体工作流,读者可复用该方法进行非代码类知识的整理。
Andrej Karpathy 指出,在构建真实应用时,最困难的往往不是编写代码,而是像拼装家具一样集成各种第三方服务(DevOps)。他期待有一天,只需向智能体下达指令,它就能自动完成 API 密钥获取、文档阅读、环境调试和生产部署等全流程 DevOps 工作,从而彻底摆脱人工点击网页和按钮的操作。
推荐理由:作者指出现代应用构建中 DevOps 和繁琐的第三方服务集成是 AI 编码的主要瓶颈,并提出了让智能体全流程处理部署和配置的愿景。
ChatGPT 引入由 Agentic Commerce Protocol 驱动的高沉浸式视觉购物体验,支持商品发现、并排比较和商户集成。
推荐理由:官方说明了 Agentic Commerce Protocol 在购物场景的应用,读者可据此判断智能体如何改变商品发现与比较流程。
Mistral 发布 Mistral Small 4,将 Magistral、Pixtral、Devstral 与 Mistral Small 的指令、推理与多模态能力合并为单一模型,并以 Apache 2.0 开源。
推荐理由:原文明确给出架构、吞吐延迟优化和许可细节,读者可据此判断统一模型如何降低多模型切换成本。
OpenAI 展示了如何使用 Responses API、shell 工具和托管容器构建智能体运行时,实现运行安全、可扩展的智能体以处理文件、工具和状态。
推荐理由:OpenAI 官方阐述如何利用 Responses API 构建智能体运行时,为开发者提供集成安全容器、工具与状态管理的具体工程方法。
OpenAI 与 Amazon 宣布战略合作,将 OpenAI 的 Frontier 平台接入 AWS,并扩展 AI 基础设施、定制模型及企业级 AI Agent 能力。
推荐理由:原文说明了合作范围和落地平台,读者可据此判断基础设施与定制模型的扩展路径。
Z Code 全新版本正式上线,推出全新定义的 ADE 智能体开发环境,将 CLI 交互转化为图形化多 Agent 协作平台。Z Code 提供可视化配置管理、跨设备移动端远程开发、多任务并行处理、会话级版本管理、内置浏览器调试面板和 GLM-5 模型支持等功能,支持主流 CLI 工具灵活切换和模型映射配置。
推荐理由:产品以图形化封装 Claude Code 等 CLI 工具,并支持移动端多任务协同,为降低 Agent 工作流门槛提供了具体方案。
OpenAI 推出 OpenAI Frontier,这是一个用于构建、部署和管理 AI 智能体的企业平台。该平台支持共享上下文、用户入职、权限管理和治理功能。
推荐理由:官方给出企业级平台定位,明确了其在构建、部署和管理 AI 智能体方面提供的共享上下文、权限与治理能力。
OpenAI 发布了用于嵌入 Codex 智能体的 Codex App Server。该服务基于双向 JSON-RPC API,支持流式进度反馈、工具使用、审批和差异对比功能。
推荐理由:官方解释了 Codex App Server 的底层机制,提供了构建双向通信架构的技术参考。
OpenAI 发布面向 macOS 的 Codex 应用,作为 AI 编码和软件开发的指挥中心。该应用支持多智能体、并行工作流和长时运行任务。
推荐理由:官方给出了 Codex 应用的核心定位和关键能力,读者可以据此判断其多智能体并行工作流对长任务编码的影响。
OpenAI 介绍其 AI 智能体在打开链接时的内置安全保障措施,旨在防止基于 URL 的数据泄露和提示注入。
DeepSeek 官方发布正式版 DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale 模型。官方网页端、App 和 API 均已更新为正式版 DeepSeek-V3.2;DeepSeek-V3.2 在公开的推理类 Benchmark 测试中达到了 GPT-5 的水平,并推出了首个将思考融入工具使用的模型。
推荐理由:V3.2 将深度思考与工具调用结合并开源,Speciale 达到国际顶级竞赛人类前列水平。
Hugging Face 团队联合 Meta 推出新一代 Agent 评测基准 Gaia2 与开源执行环境 ARE,以推进 Agent 的可靠性与适变性研究。Gaia2 是 2023 年 GAIA 的升级版,采用 CC BY 4.0 许可;ARE 遵循 MIT 许可,用于运行、调试和评测 Agent。
推荐理由:Hugging Face 联合 Meta 推出新一代 Agent 评测基准 Gaia2 与执行环境 ARE,为社区提供了更贴近真实世界的调试工具。
OpenAI 发布 GPT-5 系统卡增补,介绍专为 Codex 中 Agentic 编码优化的模型 GPT-5-Codex。该模型能根据任务复杂度动态调整推理投入,对简单查询快速响应,对复杂任务则独立工作更长时间。