Velokey

Gemini 3.1 Flash Lite Preview

Google对话输入 0.2 · 输出 1.2 积分 / 1M tokens≈$0.2 / $1.2可用

Gemini 3.1 Flash 是 Gemini 3 系列中最具性价比的预览模型,兼具强劲智能、高吞吐低延迟与多模态输入。通过 Velokey 统一端点接入,享受官方价折扣。

Gemini 3 系列最具性价比363 tokens/秒灵活推理级别100 万 token 多模态输入

适用场景

编码与 UI 生成、规模化翻译与数据标注

输入

文本、图像

输出

文本

计费方式

按 token 计费

0.7
02
2048
2568192
gemini-3.1-flash-lite-preview

开始对话

在下方输入消息开始对话

注册即送 $0.5 免费额度,约可免费生成 20 张图

价格详情

透明定价,无隐藏费用。按量付费,用多少付多少。

详细价格

按使用量计费的价格明细

规格价格官方价节省
Input/1M tokens0.2 积分≈$0.20.25 积分-20%
Output/1M tokens1.2 积分≈$1.21.5 积分-20%
Cache Read/1M tokens0.02 积分≈$0.020.025 积分-20%

计费规则

  • 输出价格根据模型、分辨率、质量、时长或 token 使用量而变化。
  • 上传的参考文件在支持的情况下可能单独收费。
  • 网页搜索或图像搜索等附加功能可能按请求计费。
  • 基于 token 的模型按输入和输出 token 计费。
  • 如果主路由不可用,Velokey 可能会在可能的情况下自动切换到稳定的备用路由。
  • 使用按量付费,透明扣除积分。

* 实际费用以最终输出为准。

实惠的 Gemini 3.1 Flash API

在 Velokey 上使用 Google DeepMind 最具性价比的 Gemini 3 模型 —— 高吞吐、灵活推理级别、100 万 token 多模态输入,统一端点、官方价折扣,适合生产级应用。

认识 Gemini 3.1 Flash 及其 API 接入

Gemini 3.1 Flash 是 Google DeepMind 在 Gemini 3 系列中最具性价比的模型(预览版)。它兼具强劲智能与高吞吐,输出速度约 363 tokens/秒、延迟低,并新增灵活的推理级别,让你按每个任务的复杂度匹配算力;支持文本、图像、视频、音频与 PDF 多模态输入,拥有 100 万 token 上下文窗口,具备函数调用、结构化输出、搜索接地与代码执行等工具能力。它在 GPQA Diamond、MMMU-Pro 与代码生成等基准上优于 Gemini 2.5 Flash。 Velokey 提供实惠、易集成的 Gemini 3.1 Flash API:统一聊天端点、清晰的请求流程,以及面向生产系统、高频流水线与实时应用的官方价折扣。

Gemini 3 系列中最具性价比

Gemini 3 系列中最具性价比的模型,以低价格搭配强劲智能,让高频工作负载在不牺牲质量的前提下保持实惠。

查看文档
Gemini 3 系列中最具性价比

高速与低延迟

输出速度约 363 tokens/秒、延迟低,让高并发与延迟敏感的任务保持响应迅速 —— 非常适合规模化的实时内容生成。

查看文档
高速与低延迟

灵活的推理级别

按每次请求上调或下调推理深度以匹配不同复杂度 —— 简单任务又便宜又即时,任务真正需要时再深入。

查看文档
灵活的推理级别

100 万 token 多模态输入与工具

在 100 万 token 输入上下文中接受文本、图像、视频、音频与 PDF,配合函数调用、结构化输出、搜索接地与代码执行,支撑真实的智能体工作流。

查看文档
100 万 token 多模态输入与工具

如何在 Velokey 部署 Gemini 3.1 Flash API

只需几步即可开始。

1

注册并获取 API Key

登录 Velokey 控制台生成 API Key,用于认证发送到 gemini-3-1-flash 的每一次请求。

2

配置请求参数

将 model 设置为 gemini-3-1-flash 并提交 messages。选择灵活的推理级别以在深度与速度间取得平衡,并按需附加文本、图像、视频、音频或 PDF 输入。

3

集成并开始调用

向 Velokey 统一的 /v1/chat/completions 端点发送请求,为助手、高频流水线与实时应用赋能,用量在同一控制台管理。

Gemini 3.1 Flash 的真实应用场景

从编码到大规模数据处理,覆盖众多高频场景。

编码与 UI 生成

出色的代码生成质量搭配低延迟 —— 适合编码助手与规模化 UI 生成,速度与成本二者兼顾。

规模化翻译

高性价比且快速 —— 适合持续批量处理内容的高频翻译流水线。

规模化数据标注

单次调用成本低、吞吐高 —— 适合在长时任务中标注和注释大规模数据集。

实时内容生成

363 tokens/秒搭配低延迟 —— 适合在线产品与交互体验中的实时内容生成。

延迟敏感型推理

灵活的推理级别让响应保持迅速,同时在需要时仍能推理 —— 适合延迟敏感型助手。

多模态理解

在 100 万 token 上下文中接受文本、图像、视频、音频与 PDF 输入 —— 适合分析与总结混合媒体内容。

为何为 Gemini 3.1 Flash 选择 Velokey

官方价折扣

在 Velokey 以更低价格调用 Gemini 3.1 Flash —— 按量付费、无强制订阅,让高频工作负载保持实惠。

统一 API 接口

一个 API Key 即可访问 Gemini 3.1 Flash 与其他模型 —— 无需管理多个账户与密钥,简化集成。

完整文档与集成指引

端点参考、参数说明与示例,助你快速接入推理级别、多模态输入与工具能力。

稳定且高可用

自动故障切换与稳定的回退路由,在主路由中断时维持可用性,保障生产可靠。

API 参考

完整的 API 调用示例和参数说明

Endpoint

https://api.velokey.ai/v1beta/models/{model}:generateContent

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-lite-preview",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "gemini-3.1-flash-lite-preview",
  "created": 1234567890,
  "data": { ... }
}

Gemini 3.1 Flash API 常见问题

Gemini 3.1 Flash 最适合做什么?

它是 Gemini 3 系列中最具性价比的模型(预览版),面向既需要效率又需要智能的高频任务 —— 编码与 UI 生成、翻译、规模化数据标注、实时内容生成,以及延迟敏感型推理。

它有多快?

输出速度约 363 tokens/秒、延迟低,非常适合高并发与延迟敏感的工作负载。灵活的推理级别可让你按任务在深度与速度间取舍。

它支持哪些输入与工具?

支持文本、图像、视频、音频与 PDF 多模态输入、文本输出,输入上下文达 100 万 token、输出 64K。工具能力包括函数调用、结构化输出、搜索接地与代码执行。知识截止为 2025 年 1 月。

与 Gemini 2.5 Flash 相比如何?

在关键基准上优于 Gemini 2.5 Flash:GPQA Diamond 达 86.9%、MMMU-Pro 达 76.8%、代码生成达 72.0%。

在 Velokey 如何计费?

本页价格区域显示当前 Velokey 价格,按输入与输出 token 计费并在官方价基础上打折。一个 API Key 即可同时使用 Gemini 3.1 Flash 与其他模型。

立即开始使用 Gemini 3.1 Flash Lite Preview

使用一个 API Key 通过 Velokey 访问低成本、稳定的 AI 模型。