Velokey

MiniMax M3

MiniMax对话输入 0.24 · 输出 0.96 积分 / 1M tokens≈$0.24 / $0.96可用

MiniMax M3 是首个同时具备顶尖编码、百万 token 上下文与原生多模态三大前沿能力的开源权重模型。通过 Velokey 统一端点接入,享受官方价折扣。

三大前沿能力合一顶尖编码与 Agent100 万 token 上下文原生多模态

适用场景

深度编码与代码库工作、自主 Agent 与工具调用

输入

文本、图像

输出

文本

计费方式

按 token 计费

0.7
02
2048
2568192
MiniMax-M3

开始对话

在下方输入消息开始对话

注册即送 $0.5 免费额度,约可免费生成 20 张图

价格详情

透明定价,无隐藏费用。按量付费,用多少付多少。

详细价格

阶梯定价

按使用量计费的价格明细

MiniMax M3

<= 512K tokens上下文长度 ≤ 512K
规格价格Official/Fal Price(USD)节省
Input/1M tokens0.24 积分≈$0.240.3 积分-20%
Output/1M tokens0.96 积分≈$0.961.2 积分-20%
Cache Read/1M tokens0.048 积分≈$0.0480.06 积分-20%
> 512K tokens上下文长度 > 512K
规格价格Official/Fal Price(USD)节省
Input/1M tokens0.48 积分≈$0.480.6 积分-20%
Output/1M tokens1.92 积分≈$1.922.4 积分-20%
Cache Read/1M tokens0.096 积分≈$0.0960.12 积分-20%

计费规则

  • 输出价格根据模型、分辨率、质量、时长或 token 使用量而变化。
  • 上传的参考文件在支持的情况下可能单独收费。
  • 网页搜索或图像搜索等附加功能可能按请求计费。
  • 基于 token 的模型按输入和输出 token 计费。
  • 如果主路由不可用,Velokey 可能会在可能的情况下自动切换到稳定的备用路由。
  • 使用按量付费,透明扣除积分。

* 实际费用以最终输出为准。

经济实惠的 MiniMax M3 API

在 Velokey 上接入 MiniMax M3——首个同时具备顶尖编码、100 万 token 上下文与原生多模态的开源权重模型,配合统一端点和官方价折扣,直接用于生产级应用。

认识 MiniMax M3 及其 API 接入

MiniMax M3 是 MiniMax 推出的文本模型,也是首个同时集成三大前沿能力的开源权重模型:顶尖编码、100 万 token 上下文与原生多模态。它在编码与 Agent 基准上表现顶尖,可自主拆解任务、调用工具并进行多步推理;文本与视觉语义空间深度对齐,实现原生多模态理解;并通过 MiniMax Sparse Attention(MSA)架构支持最高 100 万 token 上下文(保证不低于 512K)。 Velokey 提供经济实惠、易于集成的 MiniMax M3 API:统一的对话端点、清晰的请求流程,以及官方价基础上的折扣,可直接接入生产系统、Agent 流程和自动化工具。

三大前沿能力,一个开源权重模型

首个同时具备顶尖编码、100 万 token 上下文与原生多模态三大前沿能力的开源权重模型,将过去分散的能力集成于一体。

查看文档
三大前沿能力,一个开源权重模型

顶尖编码与自主 Agent

在编码与 Agent 基准上表现顶尖,可自主拆解任务、调用工具并进行多步推理,曾完成 12 小时 ICLR 论文复现与达 9.4 倍加速的 CUDA 内核优化。

查看文档
顶尖编码与自主 Agent

100 万 token 上下文(MSA 架构)

基于 MiniMax Sparse Attention(MSA)架构,支持最高 100 万 token 上下文,并保证不低于 512K,可高效处理超长代码库与文档。

查看文档
100 万 token 上下文(MSA 架构)

原生多模态

文本与视觉语义空间深度对齐,原生实现多模态理解,而非事后拼接的外挂能力。

查看文档
原生多模态

如何在 Velokey 上部署 MiniMax M3 API

只需几个步骤即可开始调用。

1

注册并获取 API Key

登录 Velokey 控制台生成 API Key,用于认证所有发送到 MiniMax M3 的请求。

2

配置请求参数

将 model 设为 minimax-m3,提交 messages。可通过 v2.1 端点使用编码、Agent 工具调用与超长上下文能力。

3

集成并开始调用

通过 Velokey 统一 /v1/chat/completions 端点发送请求,即可接入助手、Agent 和自动化流程,并在控制台统一管理用量。

MiniMax M3 的真实应用场景

从工程到研究,覆盖多种高自主度场景。

深度编码与代码库工作

顶尖编码能力配合 100 万 token 上下文,适合跨整个代码库的开发、重构与调优。

自主 Agent 与工具调用

自主拆解任务、调用工具、多步推理,适合复杂 Agent 工作流与长程自动化。

研究复现与工程优化

曾完成 12 小时 ICLR 论文复现与达 9.4 倍加速的 CUDA 内核优化,适合科研与性能工程。

超长文档与代码库理解

100 万 token 上下文可跨越超长文档与整个代码库进行检索、综合与问答。

多模态理解与分析

文本与视觉语义深度对齐,适合图文混合的理解、分析与内容处理任务。

长程自动化流程

自主拆解任务与工具调用,适合需要多步执行与工具编排的自动化流程。

为什么选择 Velokey 接入 MiniMax M3

官方价基础上的折扣

在 Velokey 以更低的价格调用 MiniMax M3,按量付费、无强制订阅,降低前期成本。

统一的 API 接口

一个 API Key 即可访问 MiniMax M3 与其他模型,无需管理多个账户与密钥,简化集成。

完善的文档与接入指引

提供端点说明、参数细节与示例,帮助你快速用上编码、Agent 与长上下文能力。

稳定与高可用

自动故障转移与稳定备用路由,在主路由不可用时维持可用性,保障生产稳定。

API 参考

完整的 API 调用示例和参数说明

Endpoint

https://api.velokey.ai/v1/chat/completions

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1/chat/completions \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MiniMax-M3",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "MiniMax-M3",
  "created": 1234567890,
  "data": { ... }
}

MiniMax M3 API 常见问题

MiniMax M3 有什么独特之处?

它是首个同时具备三大前沿能力的开源权重模型:顶尖编码、100 万 token 上下文与原生多模态,将过去分散在不同模型上的能力集成于一体。

长上下文能力如何?

基于 MiniMax Sparse Attention(MSA)架构,支持最高 100 万 token 上下文,并保证不低于 512K,可高效处理超长代码库与文档。

它在基准上的表现如何?

在 BrowseComp 上取得 83.5(超过 Opus 4.7 的 79.3),在 PostTrainBench 上以 37.1 位列总榜第 3,并展示了 12 小时 ICLR 论文复现与达 9.4 倍加速的 CUDA 内核优化。

有哪些接入方式?

可通过 API(v2.1 端点)、Token Plan 套餐、MiniMax Code 无代码 Agent 界面接入,开源部署(HuggingFace/GitHub)即将上线。

在 Velokey 上如何计费?

本页价格区会展示当前 Velokey 价格,按输入和输出 token 计费,并在官方价基础上提供折扣,无需强制订阅。

立即开始使用 MiniMax M3

使用一个 API Key 通过 Velokey 访问低成本、稳定的 AI 模型。