同步自 OpenRouter · 400 个模型 · source=openrouter · 2026-08-10T01:42:58.719Z
GLM 5.2
z-ai/glm-5.2
GLM 5.2 是 Z.ai 推出的旗舰级长上下文推理模型,支持 1M token 上下文窗口,专为长时程任务设计。它在项目级软件工程、复杂 Agent 工作流和多步自动化方面表现突出,尤其擅长编码与工具使用,能够在单一任务中维持工程上下文并遵循标准完成从需求到多平台部署的全流程。模型支持高 reasoning effort 模式,包括 high 和 xhigh。参数规模约 744B(MoE,40B 激活),基于 IndexShare 架构优化。适用于需要深度推理和持久上下文的场景。以厂商/网关为准其他细节。
Z.ai 长上下文推理模型,专注长时程 Agent 与项目级编码

GLM / 智谱
Z.ai · 知识库 159 模 / 31 族
Z.ai 长上下文推理模型,专注长时程 Agent 与项目级编码
GLM 5.2 是 Z.ai 推出的旗舰级长上下文推理模型,支持 1M token 上下文窗口,专为长时程任务设计。它在项目级软件工程、复杂 Agent 工作流和多步自动化方面表现突出,尤其擅长编码与工具使用,能够在单一任务中维持工程上下文并遵循标准完成从需求到多平台部署的全流程。模型支持高 reasoning effort 模式,包括 high 和 xhigh。参数规模约 744B(MoE,40B 激活),基于 IndexShare 架构优化。适用于需要深度推理和持久上下文的场景。以厂商/网关为准其他细节。
智谱 GLM 系列,中英双语与 Agent/代码场景应用广泛。
GLM 5.2 is a large-scale reasoning model from Z.ai. It supports text input and output with a 1M-token context window, and is suited for long-horizon agent workflows, project-level software engineering,...
- Z.ai 长上下文推理模型,专注长时程 Agent 与项目级编码
- 当前版本线 5.2
- 归并版本 13 个
- GLM 5.2 版本,支持 1M token 上下文,MoE 架构(744B 参数,40B 激活),前代 GLM-5.1
适用场景
- 长时程 Agent 工作流
- 项目级软件工程
- 复杂多步自动化任务
能力 / 优势
- 长上下文处理
- 高级推理与思考
- 项目级软件工程
- Agentic 工具调用与自动化
边界 / 不适合
- 多模态输入输出
- 低延迟实时对话
接入提示:OpenAI 兼容 API,通过 OpenRouter 网关接入,模型 ID z-ai/glm-5.2,支持 reasoning 模式与函数调用
常见问题
GLM 5.2 的上下文长度是多少?
支持 1M token 上下文窗口。
是否支持多模态?
以厂商/网关为准,目前主要支持文本输入输出。
如何接入 OpenRouter?
使用 OpenAI 兼容端点,模型 ID 为 z-ai/glm-5.2。
历史版本 / 相关变体
| 版本 | 模型 | 参数 | 来源 | 说明 |
|---|---|---|---|---|
| 5.2当前 | GLM 5.2 z-ai/glm-5.2 | — | OpenRouter | |
| 5.1 | GLM 5.1 z-ai/glm-5.1 | — | OpenRouter | |
| 4.7 | GLM 4.7 Flash z-ai/glm-4.7-flash | — | OpenRouter | |
| 4.7 | GLM 4.7 z-ai/glm-4.7 | — | OpenRouter | |
| 4.6 | GLM 4.6 z-ai/glm-4.6 | — | OpenRouter | |
| 4.5 | GLM 4.5 z-ai/glm-4.5 | — | OpenRouter | |
| 4.5 | GLM 4.5 Air z-ai/glm-4.5-air | — | OpenRouter | |
| — | GLM 5.2 (batch) z-ai/glm-5.2:batch | — | OpenRouter | |
| — | GLM 5V Turbo z-ai/glm-5v-turbo | — | OpenRouter | |
| — | GLM 5 Turbo z-ai/glm-5-turbo | — | OpenRouter | |
| — | GLM 5 z-ai/glm-5 | — | OpenRouter | |
| — | GLM 4.6V z-ai/glm-4.6v | — | OpenRouter | |
| — | GLM 4.5V z-ai/glm-4.5v | — | OpenRouter |
定价与限制
| 输入 | $0.070 / 百万 tokens |
| 输出 | $0.220 / 百万 tokens |
| 缓存读 / 写 | $0.013 / — |
| 最大输出 | 128k |
| 输入模态 | text |
| 输出模态 | text |
| HF | zai-org/GLM-5.2 |
支持参数
价格与基准分优先同步自 OpenRouter;网关短 ID 由本站平台清单补全,介绍/历史版本融合 Hugging Face 检索与家族知识库。能力验真请用 bench_v1 实验室 · OCR 天梯。
关于本页实体
GLM 5.2:怎么用本页做决策
GLM 5.2 模型页汇总价格、上下文与能力线索,并与天梯/排行联动。
深度解读见相关指南;跑分与挂价会更新,请以当日快照为准。
相关指南
- 2026 开源 LLM 本地部署实战:GLM-5.2 与 DeepSeek-V4 量化指南 — 聚焦 2026 年主流开源模型本地部署路径,包括 GLM-5.2、DeepSeek-V4、Gemma 4 的量化、vLLM/Ollama 部署方案、显存计算与中
- 2026 本地 LLM VRAM 天梯:从 8GB 到 80GB+ 最佳开源模型匹配指南 — 基于 2026 年最新开源模型(如 Qwen3、DeepSeek V4、GLM-5.2)与 RTX 50 系列、消费级 GPU 实测,构建完整 VRAM 消耗天
- 2026 本地部署实战:Gemma 4、GLM-5.2 与 DeepSeek-V4 在消费级 GPU 上的量化与推理优化 — 详细对比 2026 年主流开源模型在单卡 24GB~48GB GPU 上的部署方案,包括 llama.cpp、vLLM、Ollama 工具链、FP8/4bit
- 2026 本地 LLM 天梯:按 VRAM 从 4GB 到 80GB 最优模型实测推荐 — 基于 2026 年最新量化技术与 RTX 50 系列 GPU,详细拆解不同显存配置下 Qwen3、Mistral Large 3、GLM-5 等模型的实际性能、
- 2026 Grok 编码模型天梯:性价比与选型实战榜 — 聚焦Grok Build 0.1编码代理天梯,实测多场景性价比、上下文长度与工具调用稳定性;对比主流模型,提供工程选型清单与硬件适配建议。
- 2026 GrokCode vLLM 本地部署生产清单:并发、显存、量化与模型天梯实战 — vLLM本地部署生产级配置全指南,聚焦并发处理能力、显存优化、量化策略与编码模型天梯性价比对比。结合GrokCode实验室实测数据,提供工程可核验的硬件搭配方案
- Grok / xAI 模型天梯在 vLLM 本地部署的性价比排行榜 — 2026年 GrokCode 模型天梯在 vLLM 本地部署场景下的编码模型排行榜,覆盖 70B 级 TCO 实测、量化策略与业务选型路径。
- 本地部署 70B 模型天梯:TCO 实测与电费卡费量化 — GrokCode 针对 70B 级别本地部署的算力账单化方案,涵盖电费、硬件卡费、量化策略实测数据与 vLLM 生产清单,助力模型天梯性价比选型。
常见问题
- GLM 5.2 的价格与能力数据从哪来?
- 公开目录、官方价表与本站监测/天梯快照。账单以官方或供应商当日为准。
主题柱
slug:z-ai/glm-5.2 · 主题柱讲方法,实时数字以本页表格为准
站内推荐
同系工具:Clavue CLI / imux IDE / clavue-2.1
Clavue · CLI 与 Agent 平台
CLI / GUI Agent 运行时、设备登录、会员额度与 OpenAI 兼容 API(api.clavue.com)。开发脚本、CI 与本地工具一条链路。
打开 Clavue ↗imux · 原生 macOS AI IDE
Clavue 平台的原生 IDE:多 Agent 分屏、Ghostty 级终端、Agent Chat、浏览器自动化与 Supervisor——不是又一个 Electron 壳。
了解 imux ↗Clavue 2.1 · 产品级大模型
旗舰模型 clavue-2.1(及 fast / pro / rev):适合复杂推理与长程 Agent 循环。Chat、imux、API 共用会员额度。
查看模型 ↗