Gemini 3 Flash Preview
Gemini 3 Flash 是 Google DeepMind 的模型,将 Pro 级推理与 Flash 级的低延迟、高效率和低成本结合在一起。通过 Velokey 统一端点接入,享受官方价折扣。
适用场景
Agent 编码与迭代开发、交互式与消费级应用
输入
文本、图像
输出
文本
计费方式
按 token 计费
开始对话
在下方输入消息开始对话
注册即送 $0.5 免费额度,约可免费生成 20 张图
价格详情
透明定价,无隐藏费用。按量付费,用多少付多少。
详细价格
按使用量计费的价格明细
| 规格 | 价格 | 官方价 | 节省 |
|---|---|---|---|
| Input/1M tokens | 0.4 积分≈$0.4 | 0.5 积分 | -20% |
| Output/1M tokens | 2.4 积分≈$2.4 | 3 积分 | -20% |
| Cache Read/1M tokens | 0.04 积分≈$0.04 | 0.05 积分 | -20% |
计费规则
- 输出价格根据模型、分辨率、质量、时长或 token 使用量而变化。
- 上传的参考文件在支持的情况下可能单独收费。
- 网页搜索或图像搜索等附加功能可能按请求计费。
- 基于 token 的模型按输入和输出 token 计费。
- 如果主路由不可用,Velokey 可能会在可能的情况下自动切换到稳定的备用路由。
- 使用按量付费,透明扣除积分。
* 实际费用以最终输出为准。
相关模型
探索同类型的其他模型。
- Google省 20%
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- Google省 20%
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- Google省 20%
Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash is Google's most cost-efficient model in the 3 series, with flexible reasoning, multimodal input and a 1M-token context for high-volume, low-latency tasks.
- Google省 20%
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
经济实惠的 Gemini 3 Flash API
在 Velokey 上接入 Google Gemini 3 Flash——以 Flash 级的延迟与成本实现 Pro 级推理、顶尖编码与多模态理解,配合统一端点和官方价折扣,直接用于生产级应用。
认识 Gemini 3 Flash 及其 API 接入
Gemini 3 Flash 是 Google DeepMind 于 2025 年 12 月 17 日发布的模型,将 Pro 级推理与 Flash 级的延迟、效率和成本结合。它把前沿推理与 Flash 系列速度融为一体——GPQA Diamond 达 90.4%、SWE-bench Verified 达 78%(超越 2.5 系列与 Gemini 3 Pro)、MMMU Pro 达 81.2%,与 Gemini 3 Pro 相当。它比 Gemini 2.5 Pro 快约 3 倍,在典型任务上少用约 30% 的 token。 Velokey 提供经济实惠、易于集成的 Gemini 3 Flash API:统一的对话端点、清晰的请求流程,以及在控制台面板中展示的官方价折扣,可直接接入生产系统、Agent 流程和消费级应用。
如何在 Velokey 上部署 Gemini 3 Flash API
只需几个步骤即可开始调用。
注册并获取 API Key
登录 Velokey 控制台生成 API Key,用于认证所有发送到 Gemini 3 Flash 的请求。
配置请求参数
将 model 设为 gemini-3-flash,提交 messages。多模态任务可加入图像或视频,保持请求精简以充分利用 Flash 级延迟。
集成并开始调用
通过 Velokey 统一 /v1/chat/completions 端点发送请求,即可接入助手、Agent 和交互式应用,并在控制台统一管理用量。
Gemini 3 Flash 的真实应用场景
从工程到交互式产品,覆盖多种低延迟场景。
Agent 编码与迭代开发
SWE-bench Verified 78% 与 Flash 级延迟——适合 Agent 编码、快速迭代与用工具的开发循环。
需要快速响应的交互式应用
低延迟、低成本——适合需要快速、高频响应的交互式应用。
实时多模态分析
视频、图像与视觉问答——适合游戏助手、设计迭代等实时场景。
复杂推理任务
GPQA Diamond 90.4%、Humanity's Last Exam(无工具)33.7%——适合高难度的科学与推理问题。
高频工作流
比 2.5 Pro 快约 3 倍、少用约 30% token——适合高吞吐、成本敏感的流程。
消费级应用
Flash 级的速度与成本——适合为大量用户提供服务的消费级产品。
为什么选择 Velokey 接入 Gemini 3 Flash
官方价基础上的折扣
在 Velokey 以更低的价格调用 Gemini 3 Flash,按量付费、无强制订阅,降低前期成本。
统一的 API 接口
一个 API Key 即可访问 Gemini 3 Flash 与其他模型,无需管理多个账户与密钥,简化集成。
完善的文档与示例
提供端点说明、参数细节和多模态示例,帮助你快速集成推理、编码与视觉能力。
稳定与高可用
自动故障转移与稳定备用路由,在主路由不可用时维持可用性,保障生产稳定。
API 参考
完整的 API 调用示例和参数说明
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-flash-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3-flash-preview",
"created": 1234567890,
"data": { ... }
}Gemini 3 Flash API 常见问题
Gemini 3 Flash 有什么不同?
它将 Pro 级推理与 Flash 级的延迟、效率和成本结合,把前沿推理与 Flash 系列速度融为一体。GPQA Diamond 达 90.4%、SWE-bench Verified 达 78%、MMMU Pro 达 81.2%,同时比 Gemini 2.5 Pro 快约 3 倍。
它的编码能力与 Gemini 3 Pro 相比如何?
在 SWE-bench Verified 上达 78%,超越 Gemini 2.5 系列与 Gemini 3 Pro——在更低延迟下对 Agent 编码与迭代开发表现出色。
它的速度与效率如何?
它比 Gemini 2.5 Pro 快约 3 倍,在典型任务上平均少用约 30% 的 token,专为低延迟、高频工作流优化。
支持哪些多模态输入?
支持视频分析、图像理解与视觉问答,适合游戏助手、设计迭代等实时多模态场景。
在 Velokey 上如何计费?
按输入和输出 token 计费,并在官方价基础上提供折扣。当前 Velokey 价格会在本页价格区与控制台面板中展示,且无强制订阅。



