智谱

z-ai/glm-5.2

模型 IDz-ai/glm-5.2

接入文档Markdown

模型简介

GLM-5.2 是 Z.AI 面向长时间编码和工程任务的文本模型,支持 1M 上下文、128K 输出和可配置推理投入。

模型能力

规格来自已列明的模型资料;目录标签用于快速判断接入能力,精确限制以来源文档为准。

OpenAI 兼容推理

已核验规格

官方定位
长时间编码与工程任务
上下文窗口
1,000,000 tokens
最大输出
128,000 tokens
已验证能力
reasoning_effort、函数调用、结构化输出、MCP

资料来源: B.AI GLM-5.2 模型指南

模型价格和接入方式

价格直接读取 MoleAPI 控制台目录,并按当前计费分组与上下文档位展示。

实际结算价格以控制台中的账户分组为准。
实时价格来源

价格表

USD / 1M tokens
标准x1default输入 $0.87 · 输出 $3.48

输入

$0.87 / 1M tokens

输出

$3.48 / 1M tokens

缓存读取

$0.19 / 1M tokens

接入协议

可用计费分组: 标准

openai
POST
/v1/chat/completions

z-ai/glm-5.2 模型介绍

以下介绍经过重新组织与本地化表达,并与所列模型资料交叉核验。

GLM-5.2 是 Z.AI 面向长时间编码和工程任务的文本模型,支持 1M 上下文、128K 输出和可配置推理投入。

核心优势

  • 1M 上下文适合完整代码库和大型工程资料。
  • reasoning_effort 可调节复杂任务的推理深度。
  • 支持函数调用、流式工具调用、结构化输出、缓存和 MCP。

使用限制

  • 模型以文本为主,图像、视频和 GUI 理解需要视觉模型。
  • 超长输入和 128K 输出需要限制 max_tokens 并利用缓存。

选型与上线评估

选择 z-ai/glm-5.2 时,先把官方定位映射到真实任务:项目级代码审查、重构与迁移、长文档分析和需要 MCP 或函数调用的工程代理。 第一轮评测应同时覆盖它的主要优势“1M 上下文适合完整代码库和大型工程资料。”和已知限制“模型以文本为主,图像、视频和 GUI 理解需要视觉模型。”,而不是只比较一次通用问答的主观观感。

接入层面,MoleAPI 当前为这款 智谱 模型列出 openai 协议和 标准 计费分组;默认价格摘要为 输入 $0.87 / 1M tokens · 输出 $3.48 / 1M tokens。价格、协议与可用分组来自实时目录,正式上线前仍应按自己的上下文长度、输出规模和缓存命中率计算代表性请求成本。

目前没有展示与该精确模型 ID 和推理档位完全匹配的独立排名,因此不使用相近型号推断分数。上线前应固定模型 ID、提示词和样本集,记录正确率、结构化输出合格率、工具调用成功率与超时率,再与候选模型做同条件比较。

本页模型资料最近核验于 2026-07-24。当上游模型卡、上下文限制或工具支持发生变化时,应先更新来源与双语事实,再调整推荐结论;MoleAPI 的实时价格变化则由目录自动同步,不与静态能力描述混在一起。

代码示例

示例使用 MoleAPI 的 OpenAI 兼容地址;替换 API Key 后即可运行。

curl https://api.moleapi.com/v1/chat/completions \
  -H "Authorization: Bearer $MOLEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-5.2",
    "messages": [{"role": "user", "content": "Hello"}]
  }'

常见问题

z-ai/glm-5.2 怎么计费?

本页价格从 MoleAPI 控制台接口动态读取,并随模型价格、上下文档位和账户分组更新。

z-ai/glm-5.2 支持哪些接入方式?

本页协议和接口来自 MoleAPI 模型目录的 supported_endpoint_types 字段。

如何在现有项目中切换到 z-ai/glm-5.2?

保留 MoleAPI 的 API 地址和密钥,把请求中的 model 参数替换为本页模型 ID;再按照对应协议检查参数差异。

z-ai/glm-5.2 的模型资料来自哪里?

模型能力与限制已根据 B.AI 等页面核验;价格和可用协议只采用 MoleAPI 控制台数据。