GLM 5.2
GLM-5.2 是 Z.ai(智谱)的旗舰基础模型,专为项目级编码与长周期工程任务打造,提供 100 万 token 上下文与最高 128K 输出。通过 Velokey 统一端点接入,享受官方价折扣。
适用场景
代码库分析与重构、长周期工程任务
输入
文本
输出
文本
计费方式
按 token 计费
开始对话
在下方输入消息开始对话
注册即送 $0.5 免费额度,约可免费生成 20 张图
价格详情
透明定价,无隐藏费用。按量付费,用多少付多少。
详细价格
按使用量计费的价格明细
| 规格 | 价格 | 官方价 | 节省 |
|---|---|---|---|
| Input/1M tokens | 1.12 积分≈$1.12 | 1.4 积分 | -20% |
| Output/1M tokens | 3.52 积分≈$3.52 | 4.4 积分 | -20% |
| Cache Read/1M tokens | 0.208 积分≈$0.208 | 0.26 积分 | -20% |
计费规则
- 输出价格根据模型、分辨率、质量、时长或 token 使用量而变化。
- 上传的参考文件在支持的情况下可能单独收费。
- 网页搜索或图像搜索等附加功能可能按请求计费。
- 基于 token 的模型按输入和输出 token 计费。
- 如果主路由不可用,Velokey 可能会在可能的情况下自动切换到稳定的备用路由。
- 使用按量付费,透明扣除积分。
* 实际费用以最终输出为准。
相关模型
探索同类型的其他模型。
- Zhipu省 20%
GLM 5
GLM-5 is Z.ai's 744B-parameter (40B active) sparse-attention model with Opus-4.5-level coding, strong agentic tool use, and a 200K context.
- Zhipu省 20%
GLM 5.1
GLM-5.1 is Zhipu's flagship AI model, excelling in programming, complex reasoning, and long-chain tasks.
- OpenAI省 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
- Alibaba省 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
实惠的 GLM-5.2 API
在 Velokey 上使用 Z.ai 的 GLM-5.2——100 万 token 上下文、前沿智能体编码、可调节思考模式与完整工具支持,配合统一接入点与低于标价的价格,适合生产级应用。
认识 GLM-5.2 及其 API 接入
GLM-5.2 是 Z.ai(智谱)的旗舰基础模型,专为项目级编码与长周期工程任务打造。它提供 100 万 token 上下文窗口与最高 128K token 输出,新增由 reasoning_effort 参数控制的多种思考模式,并将智能体编码推向前沿——Terminal-Bench 2.1 从 62.0 升至 81.0,SWE-bench Pro 从 58.4 升至 62.1。它带来更强的项目级代码库理解、更稳定的多步执行、对工程规范更好的遵循,以及增强的移动端与客户端能力。 Velokey 提供实惠、易于集成的 GLM-5.2 API:统一对话接入点、清晰的请求流程,以及面向生产系统、智能体流水线与自动化工具的低于标价的价格。

前沿智能体编码
GLM-5.2 将智能体编码推向前沿:Terminal-Bench 2.1 从 62.0 升至 81.0,SWE-bench Pro 从 58.4 升至 62.1,在多步任务中可靠运行各类编码工具。
查看文档 →


如何在 Velokey 上部署 GLM-5.2 API
只需几步即可开始。
注册并获取 API Key
登录 Velokey 控制台生成 API Key,为发往 GLM-5.2 的每一次请求鉴权。
配置请求参数
将 model 设为 glm-5-2 并提交 messages。使用 reasoning_effort 参数选择思考模式,并按需启用函数调用、结构化输出或 MCP。
集成并开始调用
向 Velokey 统一的 /v1/chat/completions 接入点发送请求,驱动编码智能体、工程自动化与长周期任务,用量在一个控制台统一管理。
GLM-5.2 真实应用场景
从项目级编码到移动端与客户端工作,覆盖众多高自主度场景。
代码库分析与重构
凭借 100 万 token 上下文与更强的项目理解能力,适合分析和重构整个代码库,包括大规模跨文件改动。
长周期工程任务
稳定的多步执行适合模块解耦、API 迁移及其他必须保持在计划内的长时间运行工程任务。
生产规范落地
对工程规范更好的遵循,适合在整个项目中落实约定、评审规则与生产级质量。
移动端与小程序开发
增强的客户端能力适合 Android 与微信小程序开发调试,以及小游戏开发。
研究论文复现
强推理与长上下文适合复现研究论文、遵循方法并从原始材料重建实验。
代码转视频生成
可靠的代码生成适合用 Remotion 等代码转视频流程制作程序化视频。
为何选择 Velokey 使用 GLM-5.2
标价折扣
在 Velokey 上以更低价格调用 GLM-5.2——按量付费、无需强制订阅,降低前期成本。当前价格在控制台中展示。
统一 API 接口
一个 API Key 即可访问 GLM-5.2 及其他模型——无需在多个账户与 Key 间切换,简化集成。
完整文档与迁移指引
接入点参考、参数细节与迁移示例,助你从 GLM-5.1 平滑升级,并采用长上下文、思考模式与工具。
稳定且高可用
自动故障转移与稳定的备用路由在主线路故障时维持可用性,保障生产可靠。
API 参考
完整的 API 调用示例和参数说明
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "glm-5.2",
"created": 1234567890,
"data": { ... }
}GLM-5.2 API 常见问题
相比 GLM-5.1 有哪些提升?
GLM-5.2 带来更强的项目级代码库理解、更稳定的多步任务执行,以及对工程规范更好的遵循。基准测试上,Terminal-Bench 2.1 从 62.0 升至 81.0,SWE-bench Pro 从 58.4 升至 62.1,同时增强了移动端与客户端能力。
上下文窗口和输出有多大?
GLM-5.2 提供 100 万 token 上下文窗口,最高可产出 128K token 输出,因此能一次理解整个项目级代码库,同时生成大规模重构或长篇响应。上下文缓存有助于让长对话保持高效。
思考模式和 reasoning_effort 如何工作?
GLM-5.2 支持由 reasoning_effort 参数(例如 "max")控制的多种思考模式,让你在处理难题时调高推理深度,或在简单请求上调低以降低延迟。
支持哪些工具与集成能力?
GLM-5.2 支持函数调用与工具调用、流式响应、结构化 JSON 输出以及 MCP 集成,并为长对话提供上下文缓存——构建真实智能体流水线所需的能力一应俱全。
在 Velokey 上如何计费?
你通过一个统一接入点与 API Key、以低于标价的价格调用 GLM-5.2。本页价格区域会在控制台展示当前 Velokey 价格,按输入与输出 token 计费,并在标价基础上给予折扣。