Velokey

Gemini 3 Flash Preview

Google对话输入 0.4 · 输出 2.4 积分 / 1M tokens≈$0.4 / $2.4可用

Gemini 3 Flash 是 Google DeepMind 的模型,将 Pro 级推理与 Flash 级的低延迟、高效率和低成本结合在一起。通过 Velokey 统一端点接入,享受官方价折扣。

Pro 级推理SWE-bench 78%比 2.5 Pro 快 3 倍图像与视频多模态

适用场景

Agent 编码与迭代开发、交互式与消费级应用

输入

文本、图像

输出

文本

计费方式

按 token 计费

0.7
02
2048
2568192
gemini-3-flash-preview

开始对话

在下方输入消息开始对话

注册即送 $0.5 免费额度,约可免费生成 20 张图

价格详情

透明定价,无隐藏费用。按量付费,用多少付多少。

详细价格

按使用量计费的价格明细

规格价格官方价节省
Input/1M tokens0.4 积分≈$0.40.5 积分-20%
Output/1M tokens2.4 积分≈$2.43 积分-20%
Cache Read/1M tokens0.04 积分≈$0.040.05 积分-20%

计费规则

  • 输出价格根据模型、分辨率、质量、时长或 token 使用量而变化。
  • 上传的参考文件在支持的情况下可能单独收费。
  • 网页搜索或图像搜索等附加功能可能按请求计费。
  • 基于 token 的模型按输入和输出 token 计费。
  • 如果主路由不可用,Velokey 可能会在可能的情况下自动切换到稳定的备用路由。
  • 使用按量付费,透明扣除积分。

* 实际费用以最终输出为准。

经济实惠的 Gemini 3 Flash API

在 Velokey 上接入 Google Gemini 3 Flash——以 Flash 级的延迟与成本实现 Pro 级推理、顶尖编码与多模态理解,配合统一端点和官方价折扣,直接用于生产级应用。

认识 Gemini 3 Flash 及其 API 接入

Gemini 3 Flash 是 Google DeepMind 于 2025 年 12 月 17 日发布的模型,将 Pro 级推理与 Flash 级的延迟、效率和成本结合。它把前沿推理与 Flash 系列速度融为一体——GPQA Diamond 达 90.4%、SWE-bench Verified 达 78%(超越 2.5 系列与 Gemini 3 Pro)、MMMU Pro 达 81.2%,与 Gemini 3 Pro 相当。它比 Gemini 2.5 Pro 快约 3 倍,在典型任务上少用约 30% 的 token。 Velokey 提供经济实惠、易于集成的 Gemini 3 Flash API:统一的对话端点、清晰的请求流程,以及在控制台面板中展示的官方价折扣,可直接接入生产系统、Agent 流程和消费级应用。

以 Flash 成本实现 Pro 级推理

把前沿推理与 Flash 系列速度融为一体:GPQA Diamond 达 90.4%、Humanity's Last Exam(无工具)达 33.7%,在多项基准上超越 Gemini 2.5 Pro——全部以 Flash 级的延迟与成本实现。

查看文档
以 Flash 成本实现 Pro 级推理

超越 3 Pro 的顶尖编码

SWE-bench Verified 达 78%,超越 Gemini 2.5 系列与 Gemini 3 Pro——适合 Agent 编码、工具使用与迭代开发循环。

查看文档
超越 3 Pro 的顶尖编码

快 3 倍,少用 30% token

比 Gemini 2.5 Pro 快约 3 倍,在典型任务上平均少用约 30% 的 token,专为低延迟、高频工作流优化。

查看文档
快 3 倍,少用 30% token

实时多模态理解

支持视频分析、图像理解与视觉问答,适合游戏助手、设计迭代等实时多模态场景。

查看文档
实时多模态理解

如何在 Velokey 上部署 Gemini 3 Flash API

只需几个步骤即可开始调用。

1

注册并获取 API Key

登录 Velokey 控制台生成 API Key,用于认证所有发送到 Gemini 3 Flash 的请求。

2

配置请求参数

将 model 设为 gemini-3-flash,提交 messages。多模态任务可加入图像或视频,保持请求精简以充分利用 Flash 级延迟。

3

集成并开始调用

通过 Velokey 统一 /v1/chat/completions 端点发送请求,即可接入助手、Agent 和交互式应用,并在控制台统一管理用量。

Gemini 3 Flash 的真实应用场景

从工程到交互式产品,覆盖多种低延迟场景。

Agent 编码与迭代开发

SWE-bench Verified 78% 与 Flash 级延迟——适合 Agent 编码、快速迭代与用工具的开发循环。

需要快速响应的交互式应用

低延迟、低成本——适合需要快速、高频响应的交互式应用。

实时多模态分析

视频、图像与视觉问答——适合游戏助手、设计迭代等实时场景。

复杂推理任务

GPQA Diamond 90.4%、Humanity's Last Exam(无工具)33.7%——适合高难度的科学与推理问题。

高频工作流

比 2.5 Pro 快约 3 倍、少用约 30% token——适合高吞吐、成本敏感的流程。

消费级应用

Flash 级的速度与成本——适合为大量用户提供服务的消费级产品。

为什么选择 Velokey 接入 Gemini 3 Flash

官方价基础上的折扣

在 Velokey 以更低的价格调用 Gemini 3 Flash,按量付费、无强制订阅,降低前期成本。

统一的 API 接口

一个 API Key 即可访问 Gemini 3 Flash 与其他模型,无需管理多个账户与密钥,简化集成。

完善的文档与示例

提供端点说明、参数细节和多模态示例,帮助你快速集成推理、编码与视觉能力。

稳定与高可用

自动故障转移与稳定备用路由,在主路由不可用时维持可用性,保障生产稳定。

API 参考

完整的 API 调用示例和参数说明

Endpoint

https://api.velokey.ai/v1beta/models/{model}:generateContent

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-flash-preview",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "gemini-3-flash-preview",
  "created": 1234567890,
  "data": { ... }
}

Gemini 3 Flash API 常见问题

Gemini 3 Flash 有什么不同?

它将 Pro 级推理与 Flash 级的延迟、效率和成本结合,把前沿推理与 Flash 系列速度融为一体。GPQA Diamond 达 90.4%、SWE-bench Verified 达 78%、MMMU Pro 达 81.2%,同时比 Gemini 2.5 Pro 快约 3 倍。

它的编码能力与 Gemini 3 Pro 相比如何?

在 SWE-bench Verified 上达 78%,超越 Gemini 2.5 系列与 Gemini 3 Pro——在更低延迟下对 Agent 编码与迭代开发表现出色。

它的速度与效率如何?

它比 Gemini 2.5 Pro 快约 3 倍,在典型任务上平均少用约 30% 的 token,专为低延迟、高频工作流优化。

支持哪些多模态输入?

支持视频分析、图像理解与视觉问答,适合游戏助手、设计迭代等实时多模态场景。

在 Velokey 上如何计费?

按输入和输出 token 计费,并在官方价基础上提供折扣。当前 Velokey 价格会在本页价格区与控制台面板中展示,且无强制订阅。

立即开始使用 Gemini 3 Flash Preview

使用一个 API Key 通过 Velokey 访问低成本、稳定的 AI 模型。