MiniMax M3
MiniMax M3 是首个同时具备顶尖编码、百万 token 上下文与原生多模态三大前沿能力的开源权重模型。通过 Velokey 统一端点接入,享受官方价折扣。
适用场景
深度编码与代码库工作、自主 Agent 与工具调用
输入
文本、图像
输出
文本
计费方式
按 token 计费
开始对话
在下方输入消息开始对话
注册即送 $0.5 免费额度,约可免费生成 20 张图
价格详情
透明定价,无隐藏费用。按量付费,用多少付多少。
详细价格
阶梯定价按使用量计费的价格明细
MiniMax M3
| 规格 | 价格 | Official/Fal Price(USD) | 节省 |
|---|---|---|---|
| Input/1M tokens | 0.24 积分≈$0.24 | 0.3 积分 | -20% |
| Output/1M tokens | 0.96 积分≈$0.96 | 1.2 积分 | -20% |
| Cache Read/1M tokens | 0.048 积分≈$0.048 | 0.06 积分 | -20% |
| 规格 | 价格 | Official/Fal Price(USD) | 节省 |
|---|---|---|---|
| Input/1M tokens | 0.48 积分≈$0.48 | 0.6 积分 | -20% |
| Output/1M tokens | 1.92 积分≈$1.92 | 2.4 积分 | -20% |
| Cache Read/1M tokens | 0.096 积分≈$0.096 | 0.12 积分 | -20% |
计费规则
- 输出价格根据模型、分辨率、质量、时长或 token 使用量而变化。
- 上传的参考文件在支持的情况下可能单独收费。
- 网页搜索或图像搜索等附加功能可能按请求计费。
- 基于 token 的模型按输入和输出 token 计费。
- 如果主路由不可用,Velokey 可能会在可能的情况下自动切换到稳定的备用路由。
- 使用按量付费,透明扣除积分。
* 实际费用以最终输出为准。
相关模型
探索同类型的其他模型。
- MiniMax省 20%
MiniMax M2.7
MiniMax M2.7 is a top open-source model for real-world software engineering and agent building, with strong tool skill-adherence and office-document editing.
- OpenAI省 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
- Alibaba省 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
- Anthropic省 20%
Claude Fable 5
Anthropic's Mythos-class frontier model, state-of-the-art across coding, agentic work, vision, and scientific research.
经济实惠的 MiniMax M3 API
在 Velokey 上接入 MiniMax M3——首个同时具备顶尖编码、100 万 token 上下文与原生多模态的开源权重模型,配合统一端点和官方价折扣,直接用于生产级应用。
认识 MiniMax M3 及其 API 接入
MiniMax M3 是 MiniMax 推出的文本模型,也是首个同时集成三大前沿能力的开源权重模型:顶尖编码、100 万 token 上下文与原生多模态。它在编码与 Agent 基准上表现顶尖,可自主拆解任务、调用工具并进行多步推理;文本与视觉语义空间深度对齐,实现原生多模态理解;并通过 MiniMax Sparse Attention(MSA)架构支持最高 100 万 token 上下文(保证不低于 512K)。 Velokey 提供经济实惠、易于集成的 MiniMax M3 API:统一的对话端点、清晰的请求流程,以及官方价基础上的折扣,可直接接入生产系统、Agent 流程和自动化工具。


100 万 token 上下文(MSA 架构)
基于 MiniMax Sparse Attention(MSA)架构,支持最高 100 万 token 上下文,并保证不低于 512K,可高效处理超长代码库与文档。
查看文档 →

如何在 Velokey 上部署 MiniMax M3 API
只需几个步骤即可开始调用。
注册并获取 API Key
登录 Velokey 控制台生成 API Key,用于认证所有发送到 MiniMax M3 的请求。
配置请求参数
将 model 设为 minimax-m3,提交 messages。可通过 v2.1 端点使用编码、Agent 工具调用与超长上下文能力。
集成并开始调用
通过 Velokey 统一 /v1/chat/completions 端点发送请求,即可接入助手、Agent 和自动化流程,并在控制台统一管理用量。
MiniMax M3 的真实应用场景
从工程到研究,覆盖多种高自主度场景。
深度编码与代码库工作
顶尖编码能力配合 100 万 token 上下文,适合跨整个代码库的开发、重构与调优。
自主 Agent 与工具调用
自主拆解任务、调用工具、多步推理,适合复杂 Agent 工作流与长程自动化。
研究复现与工程优化
曾完成 12 小时 ICLR 论文复现与达 9.4 倍加速的 CUDA 内核优化,适合科研与性能工程。
超长文档与代码库理解
100 万 token 上下文可跨越超长文档与整个代码库进行检索、综合与问答。
多模态理解与分析
文本与视觉语义深度对齐,适合图文混合的理解、分析与内容处理任务。
长程自动化流程
自主拆解任务与工具调用,适合需要多步执行与工具编排的自动化流程。
为什么选择 Velokey 接入 MiniMax M3
官方价基础上的折扣
在 Velokey 以更低的价格调用 MiniMax M3,按量付费、无强制订阅,降低前期成本。
统一的 API 接口
一个 API Key 即可访问 MiniMax M3 与其他模型,无需管理多个账户与密钥,简化集成。
完善的文档与接入指引
提供端点说明、参数细节与示例,帮助你快速用上编码、Agent 与长上下文能力。
稳定与高可用
自动故障转移与稳定备用路由,在主路由不可用时维持可用性,保障生产稳定。
API 参考
完整的 API 调用示例和参数说明
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M3",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "MiniMax-M3",
"created": 1234567890,
"data": { ... }
}MiniMax M3 API 常见问题
MiniMax M3 有什么独特之处?
它是首个同时具备三大前沿能力的开源权重模型:顶尖编码、100 万 token 上下文与原生多模态,将过去分散在不同模型上的能力集成于一体。
长上下文能力如何?
基于 MiniMax Sparse Attention(MSA)架构,支持最高 100 万 token 上下文,并保证不低于 512K,可高效处理超长代码库与文档。
它在基准上的表现如何?
在 BrowseComp 上取得 83.5(超过 Opus 4.7 的 79.3),在 PostTrainBench 上以 37.1 位列总榜第 3,并展示了 12 小时 ICLR 论文复现与达 9.4 倍加速的 CUDA 内核优化。
有哪些接入方式?
可通过 API(v2.1 端点)、Token Plan 套餐、MiniMax Code 无代码 Agent 界面接入,开源部署(HuggingFace/GitHub)即将上线。
在 Velokey 上如何计费?
本页价格区会展示当前 Velokey 价格,按输入和输出 token 计费,并在官方价基础上提供折扣,无需强制订阅。