GLM 5.1
Velokey 上的 glm-5.1 API 提供稳定的对话与推理能力。提交 model、messages、temperature 和流式参数,即可通过统一对话端点构建 Agent、助手和业务问答。
适用场景
glm-5.1 企业助手、glm-5.1 Agent 工作流
输入
文本、图像
输出
文本
计费方式
按 token 计费
开始对话
在下方输入消息开始对话
注册即送 $0.5 免费额度,约可免费生成 20 张图
价格详情
透明定价,无隐藏费用。按量付费,用多少付多少。
详细价格
按使用量计费的价格明细
| 规格 | 价格 | 官方价 | 节省 |
|---|---|---|---|
| Input/1M tokens | 1.12 积分≈$1.12 | 1.4 积分 | -20% |
| Output/1M tokens | 3.52 积分≈$3.52 | 4.4 积分 | -20% |
| Cache Read/1M tokens | 0.208 积分≈$0.208 | 0.26 积分 | -20% |
计费规则
- 输出价格根据模型、分辨率、质量、时长或 token 使用量而变化。
- 上传的参考文件在支持的情况下可能单独收费。
- 网页搜索或图像搜索等附加功能可能按请求计费。
- 基于 token 的模型按输入和输出 token 计费。
- 如果主路由不可用,Velokey 可能会在可能的情况下自动切换到稳定的备用路由。
- 使用按量付费,透明扣除积分。
* 实际费用以最终输出为准。
相关模型
探索同类型的其他模型。
- Zhipu省 20%
GLM 5.2
GLM-5.2 is Z.ai's flagship model with a 1M-token context, strong project-level coding, stable multi-step execution, and adjustable thinking for long-horizon engineering.
- Zhipu省 20%
GLM 5
GLM-5 is Z.ai's 744B-parameter (40B active) sparse-attention model with Opus-4.5-level coding, strong agentic tool use, and a 200K context.
- OpenAI省 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
- Alibaba省 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
经济实惠的 GLM-5.1 API
在 Velokey 上接入智谱 Z.ai 的 GLM-5.1——单任务最长 8 小时持续自主执行、比肩 Opus 4.6 的 agentic 编码、自主「实验-分析-优化」闭环,以及 200K token 上下文与完整工具集成,全部通过统一端点接入,并享官方价折扣。
认识 GLM-5.1 及其 API 接入
GLM-5.1 是智谱 Z.ai 的旗舰模型(请求 id 为 glm-5-1),专为长程自主任务、复杂工程优化与真实开发工作流打造。其通用能力对齐 Claude Opus 4.6,在 SWE-Bench Pro 上取得 58.4 分,超越 GPT-5.4、Claude Opus 4.6 与 Gemini 3.1 Pro。它提供 200K token 上下文窗口、最高 128K 输出,并支持思考模式(Thinking Mode)、流式输出、函数调用、上下文缓存、结构化输出(JSON)与 MCP 工具集成。 Velokey 提供经济实惠、易于集成的 GLM-5.1 API:统一的对话端点、一个 API Key、清晰的请求流程,以及官方价基础上的折扣,可直接接入生产系统、Agent 流程和自动化工具。
如何在 Velokey 上调用 GLM-5.1 API
只需几个步骤即可开始调用。
注册并获取 API Key
登录 Velokey 控制台生成一个 API Key,用于通过统一端点认证所有发送到 GLM-5.1 的请求。
配置请求参数
将 model 设为 glm-5-1,提交 messages。需要更深推理可启用思考模式(Thinking Mode),并按需开启流式输出、函数调用或结构化输出。
集成并开始调用
通过 Velokey 统一端点发送请求,即可驱动长时运行的 Agent、编码任务与自动化流程,并在控制台统一管理用量与计费。
GLM-5.1 的真实应用场景
从长时运行 Agent 到办公生产力,覆盖多种高自主度场景。
Agentic 编码与长时开发任务
凭借最长 8 小时的持续自主执行与比肩 Opus 4.6 的编码能力,适合 agentic 编码与长时运行的开发任务。
复杂指令遵循
面向通用对话的复杂多约束指令遵循,在冗长而细致的提示中保持连贯。
创意写作
适合需要一致语气、结构与长篇连贯性的创意写作。
前端开发与网站生成
适合前端开发与整站生成,将需求转化为可运行的布局与组件。
办公生产力
生成与编辑 PowerPoint、Word、PDF 与 Excel 等产物,胜任可复用的办公生产力工作。
工程优化
自主「实验-分析-优化」闭环在 KernelBench Level 3 上实现 3.6 倍加速——适合复杂工程优化。
为什么选择 Velokey 接入 GLM-5.1
官方价基础上的折扣
在 Velokey 以更低的价格调用 GLM-5.1,按量付费、无强制订阅,降低前期成本。
统一端点,一个 API Key
一个 API Key 即可通过统一端点访问 GLM-5.1 与其他模型,无需管理多个账户与密钥。
完整的工具集成
思考模式、流式输出、函数调用、上下文缓存、结构化输出(JSON)与 MCP 工具集成开箱即用。
完善的文档与集成指引
提供端点说明、参数细节与集成示例,帮助你顺畅用上 GLM-5.1 的 200K 上下文、长程自主与工具能力。
API 参考
完整的 API 调用示例和参数说明
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.1",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "glm-5.1",
"created": 1234567890,
"data": { ... }
}glm-5.1 API 常见问题
什么是 glm-5.1 API?
glm-5.1 API 是 Velokey 提供的 对话模型。请求中将 model 设置为 glm-5-1,并提交该模型类型需要的生成参数。
glm-5.1 Playground 支持哪些参数?
glm-5.1 Playground 暴露 model 和 messages、temperature、max_tokens 和 stream 等核心字段。JSON 模式使用相同字段,方便复制到服务端。
glm-5.1 API 应该使用哪个端点?
使用 Velokey API Key,将 model 设置为 glm-5-1,并调用 /v1/chat/completions。生成类任务可按返回结果继续查询状态。
glm-5.1 如何计费?
当 Velokey 可获取模型价格数据时,本页面的价格区域会展示当前 glm-5.1 API 价格。额度可在 Velokey 账户中统一管理。
谁适合使用 glm-5.1 API?
glm-5.1 API 适合需要快速测试、内容构思、原型验证或生产接入的开发者、创作者、营销人员和产品团队。



