GLM-5.2
GLM-5.2 是智谱 AI 在 2026 年 6 月 13 日发布的编程与长程模型。2026-08-17 复核:docs.z.ai/guides/overview 仍列出 glm-5.2 和 glm-5.2-thinking,但本站现行旗舰文案是 2026 年 8 月 14 日的 GLM-5.3。本页写的是这份 MIT 权重的 744B MoE 快照,不是「智谱最新模型」。
核心功能
- 744B MoE,MIT 权重:5.3 页也把同一条 GLM-5 基座称为未改动的 base。
- 用
glm-5.2[1m]开 1M 上下文:这一代官方概述仍写 100 万 token 窗口、最大输出 131,072。 - 思考 SKU:模型表同时有
glm-5.2和glm-5.2-thinking。该表写 thinking 不支持工具。 - 不再是默认旗舰:智谱后来的后训练版本按 GLM-5.3 卖。
适用场景
- 已经在调
glm-5.2或glm-5.2[1m]的钉死智能体。 - 5.3 权重还在放的时候,自托管这份 MIT 快照。
- 集成还没迁走、仍走 GLM Coding Plan 的成本敏感编程。
限制:发布期主张(Arena 第二、对 GPT-5.5 的 SWE-bench、「六分之一价格」)是厂商自报。当事实复述前再核。工具支持因 SKU 而异;概述表写 thinking 没有工具。
定价
docs.z.ai/guides/overview,2026-08-17。价格按每百万 token。
| 模型 | 输入 | 缓存输入 | 输出 | 该表上下文 |
|---|---|---|---|---|
| glm-5.2 | $0.2 | $0.03 | $1.2 | 200K |
| glm-5.2-thinking | $1.4 | $0.26 | $4.4 | 200K |
| glm-5.3 | $1.4 | $0.26 | $4.4 | 200K |
| glm-5.3-thinking | $2.0 | $0.4 | $6.0 | 200K |
旧页只引了 $1.40 / $4.40 的 thinking 价。更便宜的 glm-5.2 行现在是第一方。Coding Plan 席位价未再核,不再保留未核实的「约 $18/月」。
快速开始
- 读 Z.ai 模型概述。
- 调
glm-5.2或glm-5.2-thinking。只有客户端仍文档化该后缀时才用glm-5.2[1m]。 - 新项目先对比 GLM-5.3。
- 需要工具时,不要默认 thinking SKU 有工具。
常见问题
GLM-5.2 还是旗舰吗?
不是。GLM-5.3 是更晚的旗舰。5.2 留在 API 表上。
为什么有的地方写 1M,价表写 200K?
概述表在 5.2/5.3 行印的是 200K。1M 窗口是旧文案里单独的 [1m] 路径。以你实际调用的 id 为准。
$1.40 / $4.40 是每次 5.2 请求的价吗?
不是。那一对是 thinking 行。非思考 glm-5.2 是 $0.2 / $1.2。
替代方案
- GLM-5.3:智谱现行编程旗舰。
- Kimi K3:100 万上下文的开源权重竞品。
- GPT-5.6 Sol:闭源的 OpenAI 前沿。
使用技巧
- 价格抄概述表,不要抄 6 月发布博客。
- 任何把 5.2 写成「最新」的句子都链到 5.3。
- 把 thinking SKU 接进智能体前,再核工具支持。
总结
GLM-5.2 仍是计费中的 MIT 权重编程快照:便宜的非思考行和贵的思考行都在,但它已不是智谱现行旗舰。读 概述,再决定留在 5.2,还是迁到 GLM-5.3。
评论
还没有评论。成为第一个评论的人!
相关工具
GLM-5.3
z.ai
智谱 AI 最新旗舰编码与网络安全模型:沿用 GLM-5 基座,仅靠后训练扩展把编程能力提升 50%,Terminal Bench 3.0 与 Agents' Last Exam(CLI)位列开源模型第一。
Muse Glimmer
developer.meta.com/ai/models/muse-glimmer
Meta 开源 30B 智能体多模态模型:从 Muse Spark 蒸馏,专为本地常驻编码与工具调用智能体设计,单张消费级 GPU 即可运行。
Muse Spark 1.2
developer.meta.com/ai/models/muse-spark
Meta 面向编码的旗舰模型,驱动 Muse Code 终端智能体:1M 上下文、更高的首试准确率、可靠的工具调用,通过 Meta Model API 提供端到端开发工作流。
相关洞察
7 款 AI 编程 CLI 用了半年,我悟出一个道理:模型再强,干活也要有监督
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness 各有性格。半年深度使用后我总结出一套分工矩阵:pi 做最省事的 CR、omp 审复杂 PR、DeepSeek Harness 配 V4 Flash 高频低成本审查、Claude Code 与 Qoder 写代码。模型再强,干活也要有监督,而且最好是独立第三方。

Anthropic Subagent:多智能体时代的架构革命
深入解析 Anthropic 的多智能体架构设计。了解如何通过 Subagent 突破上下文窗口限制,实现性能提升 90%,以及多智能体系统在 Claude Code 中的实际应用。
Claudesidian:让 Obsidian 变成 AI 驱动的第二大脑
通过 Claudesidian 这个开源项目,将 Obsidian 笔记系统与 Claude Code 完美结合。内置 PARA 方法、自定义命令、自动化工作流,从想法到实现的完整解决方案。