Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash は、Google の最もコスト効率に優れた Gemini 3 モデル(プレビュー)で、強力な知能、高いスループット、マルチモーダル入力を備えています。Velokey の統合エンドポイントを通じて、定価以下の価格で利用できます。
ユースケース
コーディング & UI 生成 · 大規模な翻訳 & データラベリング
入力
テキスト・画像
出力
テキスト
課金方式
トークン課金
会話を始める
下にメッセージを入力して始めましょう
登録で $0.5 分の無料クレジット。画像を約 20 枚無料生成できます
料金詳細
従量課金の透明な価格設定で、隠れた費用はありません。
料金詳細
使用量ベースの料金内訳
| 仕様 | 価格 | 公式価格 | 節約 |
|---|---|---|---|
| Input/1M tokens | 0.2 クレジット≈$0.2 | 0.25 クレジット | -20% |
| Output/1M tokens | 1.2 クレジット≈$1.2 | 1.5 クレジット | -20% |
| Cache Read/1M tokens | 0.02 クレジット≈$0.02 | 0.025 クレジット | -20% |
課金ルール
- 出力価格はモデル、解像度、品質、時間、トークン使用量によって変動します。
- アップロードした参照ファイルは、対応モデルでは別途課金される場合があります。
- ウェブ検索や画像検索などの追加機能はリクエストごとに課金される場合があります。
- トークンベースのモデルは入力・出力トークン数で課金されます。
- メインルートが利用できない場合、Velokey は可能な範囲で安定したフォールバックルートに自動的に切り替えることがあります。
- 従量課金制で、クレジットは透明に差し引かれます。
* 最終的な費用は生成結果によって異なります。
関連モデル
同じカテゴリの他のモデルを見る。
- Google20% オフ
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- Google20% オフ
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- Google20% オフ
Gemini 3 Flash Preview
Gemini 3 Flash brings Pro-grade reasoning at Flash-level latency and cost — strong coding (SWE-bench 78%), 3x faster than 2.5 Pro, and multimodal understanding.
- Google20% オフ
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
手頃な価格の Gemini 3.1 Flash API
Google DeepMind の最もコスト効率に優れた Gemini 3 モデルを Velokey で利用できます。高スループット、柔軟な推論レベル、1M トークンのマルチモーダル入力に対応し、本番アプリ向けに統合エンドポイントと定価以下の価格を提供します。
Gemini 3.1 Flash とその API アクセスについて
Gemini 3.1 Flash は、Google DeepMind の Gemini 3 シリーズ(プレビュー)で最もコスト効率に優れたモデルです。強力な知能と 363 トークン/秒の高スループット、低レイテンシを両立し、柔軟な推論レベルにより各タスクの複雑さに合わせて計算量を調整できます。また、テキスト、画像、動画、音声、PDF のマルチモーダル入力を 1M トークンのコンテキストウィンドウで受け付け、関数呼び出し、構造化出力、検索グラウンディング、コード実行にも対応します。GPQA Diamond、MMMU-Pro、コード生成において Gemini 2.5 Flash を上回ります。 Velokey は、手頃で統合しやすい Gemini 3.1 Flash API を提供します。統合チャットエンドポイント、明確なリクエストフロー、本番システム、大量処理パイプライン、リアルタイムアプリケーション向けの定価以下の価格を備えています。
Gemini 3 シリーズで最もコスト効率に優れる
Gemini 3 シリーズで最もコスト効率に優れたモデルで、強力な知能と低価格を両立し、品質を犠牲にすることなく大量ワークロードを手頃に保ちます。
ドキュメントを見る →


ツール付きの 1M トークンのマルチモーダル入力
1M トークンの入力コンテキストでテキスト、画像、動画、音声、PDF を受け付け、実際のエージェントワークフロー向けに関数呼び出し、構造化出力、検索グラウンディング、コード実行に対応します。
ドキュメントを見る →
Velokey で Gemini 3.1 Flash API をデプロイする方法
わずか数ステップで始められます。
サインアップして APIキーを取得
Velokey コンソールにサインインして、gemini-3-1-flash に送信されるすべてのリクエストを認証する APIキーを生成します。
リクエストパラメータを設定
model を gemini-3-1-flash に設定し、messages を送信します。深さと速度のバランスを取るために柔軟な推論レベルを選び、必要に応じてテキスト、画像、動画、音声、または PDF 入力を添付します。
統合して呼び出しを開始
Velokey の統合 /v1/chat/completions エンドポイントにリクエストを送信して、アシスタント、大量処理パイプライン、リアルタイムアプリを駆動し、使用量を 1 つのコンソールで管理します。
Gemini 3.1 Flash の実世界でのユースケース
コーディングから大規模データ作業まで、多くの大量処理シナリオをカバーします。
コーディング & UI 生成
低レイテンシで高品質なコード生成を提供し、速度とコストの両方が重要な大規模環境でのコーディングアシスタントや UI 生成に適しています。
大規模な翻訳
コスト効率が高く高速で、大量のコンテンツバッチを継続的に処理する翻訳パイプラインに適しています。
大規模なデータラベリング
低い呼び出し単価と高いスループットにより、長時間実行されるジョブで大規模データセットをラベリングおよび注釈付けする用途に適しています。
リアルタイムコンテンツ生成
低レイテンシで 363 トークン/秒を実現し、ライブプロダクトやインタラクティブ体験におけるリアルタイムコンテンツ生成に適しています。
レイテンシに敏感な推論
柔軟な推論レベルにより、必要なときには推論しつつ、応答を高速に保てます。レイテンシに敏感なアシスタントに適しています。
マルチモーダル理解
1M トークンのコンテキストでテキスト、画像、動画、音声、PDF 入力を受け付け、混合メディアコンテンツの分析と要約に適しています。
Gemini 3.1 Flash に Velokey を選ぶ理由
定価からの割引
Velokey では Gemini 3.1 Flash をより低価格で呼び出せます。強制サブスクリプションなしの従量課金制で、大量ワークロードを手頃に保ちます。
統合 API インターフェース
1 つの APIキーで Gemini 3.1 Flash と他のモデルにアクセスできます。複数のアカウントやキーを使い分ける必要がなく、統合を簡素化します。
完全なドキュメントと統合ガイダンス
エンドポイントリファレンス、パラメータの詳細、例により、推論レベル、マルチモーダル入力、ツール使用をすばやく組み込めます。
安定性と高可用性
自動フェイルオーバーと安定したフォールバックルートにより、プライマリルートがダウンしている場合でも可用性を維持し、本番環境の信頼性を保ちます。
API リファレンス
API 呼び出し例とパラメータの完全な説明
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3.1-flash-lite-preview",
"created": 1234567890,
"data": { ... }
}Gemini 3.1 Flash API FAQ
Gemini 3.1 Flash は何に最適ですか?
Gemini 3 シリーズ(プレビュー)で最もコスト効率に優れたモデルであり、効率性と知能の両方を必要とする大量処理タスク向けに構築されています。コーディングと UI 生成、翻訳、大規模なデータラベリング、リアルタイムコンテンツ生成、レイテンシに敏感な推論に適しています。
どのくらい高速ですか?
低レイテンシで約 363 トークン/秒を生成し、大量処理やレイテンシに敏感なワークロードに非常に適しています。柔軟な推論レベルにより、タスクごとに深さと速度をトレードオフできます。
どのような入力とツールに対応していますか?
マルチモーダル入力(テキスト、画像、動画、音声、PDF)に対応し、テキストを出力します。1M トークンの入力コンテキストと 64K 出力に対応しています。ツール使用には、関数呼び出し、構造化出力、検索グラウンディング、コード実行が含まれます。知識カットオフは 2025 年 1 月です。
Gemini 2.5 Flash と比べてどうですか?
主要ベンチマークで Gemini 2.5 Flash を上回り、GPQA Diamond で 86.9%、MMMU-Pro で 76.8%、コード生成で 72.0% に達しています。
Velokey ではどのように課金されますか?
このページの料金エリアには、現在の Velokey 価格が表示されており、定価からの割引付きで入力トークンと出力トークンに基づいて課金されます。1 つの APIキーで Gemini 3.1 Flash と他のモデルを利用できます。