Gemini 3.5 Flash
Velokey 上的 gemini-3.5-flash API 提供稳定的对话与推理能力。提交 model、messages、temperature 和流式参数,即可通过统一对话端点构建 Agent、助手和业务问答。
适用场景
gemini-3.5-flash 企业助手、gemini-3.5-flash Agent 工作流
输入
文本、图像
输出
文本
计费方式
按 token 计费
开始对话
在下方输入消息开始对话
注册即送 $0.5 免费额度,约可免费生成 20 张图
价格详情
透明定价,无隐藏费用。按量付费,用多少付多少。
详细价格
按使用量计费的价格明细
| 规格 | 价格 | 官方价 | 节省 |
|---|---|---|---|
| Input/1M tokens | 1.2 积分≈$1.2 | 1.5 积分 | -20% |
| Output/1M tokens | 6 积分≈$6 | 7.5 积分 | -20% |
| Cache Read/1M tokens | 0.12 积分≈$0.12 | 0.15 积分 | -20% |
计费规则
- 输出价格根据模型、分辨率、质量、时长或 token 使用量而变化。
- 上传的参考文件在支持的情况下可能单独收费。
- 网页搜索或图像搜索等附加功能可能按请求计费。
- 基于 token 的模型按输入和输出 token 计费。
- 如果主路由不可用,Velokey 可能会在可能的情况下自动切换到稳定的备用路由。
- 使用按量付费,透明扣除积分。
* 实际费用以最终输出为准。
相关模型
探索同类型的其他模型。
- Google省 20%
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- Google省 20%
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- Google省 20%
Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash is Google's most cost-efficient model in the 3 series, with flexible reasoning, multimodal input and a 1M-token context for high-volume, low-latency tasks.
- Google省 20%
Gemini 3 Flash Preview
Gemini 3 Flash brings Pro-grade reasoning at Flash-level latency and cost — strong coding (SWE-bench 78%), 3x faster than 2.5 Pro, and multimodal understanding.
经济实惠的 Google Gemini 3.5 Flash API
在 Velokey 上接入 Google DeepMind 的 Gemini 3.5 Flash——以 Flash 级延迟和规模提供面向 Agent 与编码的前沿性能,支持多模态理解与 100 万 token 上下文,配合统一端点和官方价折扣。
认识 Gemini 3.5 Flash 及其 API 接入
Gemini 3.5 Flash 是 Google DeepMind 的预览模型,为面向 Agent 与编码的前沿性能而打造。它以 Flash 级延迟和规模提供先进推理,编码与推理质量接近 Gemini Pro,同时保留 Flash 的速度与成本。它擅长 Agent 工作流——带迭代循环与多 Agent 协同的多步任务——并原生多模态,可处理文本、图像、视频、音频与 PDF。支持 100 万 token 输入上下文(6.4 万 token 输出),知识截止到 2025 年 1 月。 Velokey 提供经济实惠、易于集成的 Gemini 3.5 Flash API:统一的对话端点、一个 API Key、清晰的请求流程,以及官方价基础上的折扣,可直接接入生产系统、Agent 流程和自动化工具。
Flash 级延迟下的前沿 Agent 性能
面向 Agent 与编码的前沿性能——以 Flash 级延迟和规模提供先进推理,质量接近 Gemini Pro。在 MCP Atlas(多步工作流)上达到 83.6%,而 Gemini 3 Flash 为 62.0%;在 Finance Agent v2 上为 57.9% 对 42.6%。
查看文档 →
强大的 Agent 编码能力
擅长 Agent 编码与带迭代循环、多 Agent 协同的多步任务,在 Terminal-bench 2.1 上取得 76.2%,而 Gemini 3 Flash 为 58.0%——真实 Agent 编码能力大幅提升。
查看文档 →

100 万 token 长上下文理解
支持最高 100 万 token 输入与 6.4 万 token 输出,可在单次调用中对整个代码库、长文档与大型档案进行连贯推理,知识截止到 2025 年 1 月。
查看文档 →
如何在 Velokey 上调用 Gemini 3.5 Flash API
只需几个步骤即可开始调用。
注册并获取 API Key
登录 Velokey 控制台生成 API Key,用于认证所有发送到 Gemini 3.5 Flash 的请求。
配置请求参数
将 model 设为 gemini-3-5-flash,提交 messages。可附带文本、图像、视频、音频或 PDF 进行多模态输入,并使用 100 万 token 上下文处理超长输入。
集成并开始调用
通过 Velokey 统一端点发送请求,即可驱动 Agent、编码助手和自动化流程,并在控制台统一管理额度与用量。
Gemini 3.5 Flash 的真实应用场景
从日常任务到 Agent 编码,覆盖多种高吞吐场景。
大规模日常任务
Flash 级延迟与成本使其适合聊天、起草、问答等高并发日常任务,同时不牺牲质量。
Agent 编码
在 Terminal-bench 2.1 上表现强劲(76.2%),适合在终端与代码库中运行迭代循环的编码 Agent。
先进推理
推理质量接近 Gemini Pro,适合需要前沿思考的多步问题求解与分析。
多模态理解
可同时处理文本、图像、视频、音频与 PDF,适合媒体分析、文档解析与多模态助手。
长上下文理解
100 万 token 输入上下文可将整个代码库、长报告与大型档案纳入单次请求,进行连贯推理。
多步 Agent 工作流
在 MCP Atlas(83.6%)与 Finance Agent v2(57.9%)上表现强劲,适合在长多步工作流中协调工具的 Agent。
为什么选择 Velokey 接入 Gemini 3.5 Flash
官方价基础上的折扣
在 Velokey 以更低的价格调用 Gemini 3.5 Flash,按量付费、无强制订阅,降低前期成本。
统一的 API 接口
一个 API Key 即可访问 Gemini 3.5 Flash 与其他模型,无需管理多个账户与密钥,简化集成。
完善的文档与示例
提供端点说明、参数细节和多模态示例,帮助你快速接入 Agent、编码与长上下文调用。
稳定与高可用
自动故障转移与稳定备用路由,在主路由不可用时维持可用性,保障生产稳定。
API 参考
完整的 API 调用示例和参数说明
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.5-flash",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3.5-flash",
"created": 1234567890,
"data": { ... }
}gemini-3.5-flash API 常见问题
什么是 gemini-3.5-flash API?
gemini-3.5-flash API 是 Velokey 提供的 对话模型。请求中将 model 设置为 gemini-3-5-flash,并提交该模型类型需要的生成参数。
gemini-3.5-flash Playground 支持哪些参数?
gemini-3.5-flash Playground 暴露 model 和 messages、temperature、max_tokens 和 stream 等核心字段。JSON 模式使用相同字段,方便复制到服务端。
gemini-3.5-flash API 应该使用哪个端点?
使用 Velokey API Key,将 model 设置为 gemini-3-5-flash,并调用 /v1/chat/completions。生成类任务可按返回结果继续查询状态。
gemini-3.5-flash 如何计费?
当 Velokey 可获取模型价格数据时,本页面的价格区域会展示当前 gemini-3.5-flash API 价格。额度可在 Velokey 账户中统一管理。
谁适合使用 gemini-3.5-flash API?
gemini-3.5-flash API 适合需要快速测试、内容构思、原型验证或生产接入的开发者、创作者、营销人员和产品团队。