GPT 5.4 Mini
gpt-5.4-mini 是 OpenAI GPT-5.4 家族中小巧、快速且经济的成员,专为低延迟、高吞吐的高并发生产场景打造。
适用场景
gpt-5.4-mini 实时助手、gpt-5.4-mini 高并发生产
输入
文本、图像
输出
文本
计费方式
按 token 计费
开始对话
在下方输入消息开始对话
注册即送 $0.5 免费额度,约可免费生成 20 张图
价格详情
透明定价,无隐藏费用。按量付费,用多少付多少。
详细价格
按使用量计费的价格明细
| 规格 | 价格 | 官方价 | 节省 |
|---|---|---|---|
| Input/1M tokens | 0.6 积分≈$0.6 | 0.75 积分 | -20% |
| Output/1M tokens | 3.6 积分≈$3.6 | 4.5 积分 | -20% |
| Cache Read/1M tokens | 0.06 积分≈$0.06 | 0.075 积分 | -20% |
计费规则
- 输出价格根据模型、分辨率、质量、时长或 token 使用量而变化。
- 上传的参考文件在支持的情况下可能单独收费。
- 网页搜索或图像搜索等附加功能可能按请求计费。
- 基于 token 的模型按输入和输出 token 计费。
- 如果主路由不可用,Velokey 可能会在可能的情况下自动切换到稳定的备用路由。
- 使用按量付费,透明扣除积分。
* 实际费用以最终输出为准。
相关模型
探索同类型的其他模型。
- OpenAI省 20%
GPT 5.4
GPT-5.4 Pro is a high-performance general-purpose large language model variant developed by OpenAI.
- OpenAI省 20%
GPT 5.5
GPT-5.5 is the latest generation of large language model developed and released by OpenAI.
- Alibaba省 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
- Anthropic省 20%
Claude Fable 5
Anthropic's Mythos-class frontier model, state-of-the-art across coding, agentic work, vision, and scientific research.
经济实惠的 gpt-5.4-mini API
在 Velokey 上接入 OpenAI 小巧、快速、经济的 GPT-5.4 模型——低延迟、高吞吐、文本与视觉多模态、长上下文与强大工具调用,配合统一端点和官方价折扣,直接用于高并发生产场景。
认识 gpt-5.4-mini 及其 API 接入
gpt-5.4-mini 是 OpenAI GPT-5.4 家族中小巧、快速且经济的成员。它针对低延迟和高吞吐进行了优化,运行成本远低于 gpt-5.4 和 gpt-5.5,同时在日常任务上保持稳定的质量。它是多模态模型,支持文本与图像输入,并具备长上下文窗口、函数调用、结构化输出和流式响应。\n\ngpt-5.4-mini 非常适合作为高并发生产、实时助手、分类与抽取,以及任何希望以低价获得良好质量的成本敏感型工作负载的默认选择。Velokey 提供经济实惠、易于集成的 gpt-5.4-mini API:统一的对话端点、清晰的请求流程,以及官方价基础上的折扣,可直接接入生产系统、Agent 流程和自动化工具。

规模化成本更低
以每 100 万输入 token 0.75 Credits、每 100 万输出 token 4.5 Credits 计费,gpt-5.4-mini 远比 gpt-5.4 和 gpt-5.5 便宜,非常适合高并发生产和成本敏感的工作负载。
查看文档 →


如何在 Velokey 上部署 gpt-5.4-mini API
只需几个步骤即可开始调用。
注册并获取 API Key
登录 Velokey 控制台生成 API Key,用于认证所有发送到 gpt-5.4-mini 的请求。
配置请求参数
将 model 设为 gpt-5-4-mini,提交 messages。通过 temperature、max_tokens 和流式输出在质量、延迟和成本之间取得平衡,以支撑高并发流量。
集成并开始调用
通过 Velokey 统一 /v1/chat/completions 端点发送请求,即可接入助手、Agent 和自动化流程,并在控制台统一管理用量。
gpt-5.4-mini 的真实应用场景
从实时助手到高并发数据工作,覆盖多种成本敏感场景。
实时助手与对话
支撑低延迟对话、客服机器人和交互式助手,用快速响应保持流畅体验。
高并发生产
以低成本处理大规模请求量,适合持续处理大量输入的流水线。
分类与抽取
可靠地完成大规模的打标、路由,以及从文本和文档中提取结构化字段。
工具调用 Agent
支持函数调用与结构化输出,是多步骤 Agent 与自动化的经济引擎。
成本敏感型工作负载
以低价提供良好质量,当预算比峰值推理深度更重要时是强力默认选择。
视觉理解
在生产中结合文本读取图像,用于图像描述、内容审核和多模态分析。
为什么选择 Velokey 接入 gpt-5.4-mini
官方价基础上的折扣
在 Velokey 以更低的价格调用 gpt-5.4-mini,按量付费、无强制订阅,降低前期成本。
统一的 API 接口
一个 API Key 即可访问 gpt-5.4-mini 与其他模型,无需管理多个账户与密钥,简化集成。
完善的文档与迁移指引
提供端点说明、参数细节和迁移示例,帮助你快速把高并发流量迁移到 gpt-5.4-mini。
稳定与高可用
自动故障转移与稳定备用路由,在主路由不可用时维持可用性,保障生产稳定。
API 参考
完整的 API 调用示例和参数说明
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-mini",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gpt-5.4-mini",
"created": 1234567890,
"data": { ... }
}gpt-5.4-mini API 常见问题
什么是 gpt-5.4-mini API?
gpt-5.4-mini API 是 Velokey 提供的 对话模型。请求中将 model 设置为 gpt-5-4-mini,并提交该模型类型需要的生成参数。
gpt-5.4-mini Playground 支持哪些参数?
gpt-5.4-mini Playground 暴露 model 和 messages、temperature、max_tokens 和 stream 等核心字段。JSON 模式使用相同字段,方便复制到服务端。
gpt-5.4-mini API 应该使用哪个端点?
使用 Velokey API Key,将 model 设置为 gpt-5-4-mini,并调用 /v1/chat/completions。生成类任务可按返回结果继续查询状态。
gpt-5.4-mini 如何计费?
当 Velokey 可获取模型价格数据时,本页面的价格区域会展示当前 gpt-5.4-mini API 价格。额度可在 Velokey 账户中统一管理。
谁适合使用 gpt-5.4-mini API?
gpt-5.4-mini API 适合需要快速、经济地处理高并发、对延迟敏感工作负载的开发者、创作者和产品团队。