Gemini 3 Flash Preview
Gemini 3 Flashは、Proグレードの推論とFlashレベルの低レイテンシ、効率、コストを組み合わせたGoogle DeepMindのモデルです。Velokeyの統合エンドポイントから、定価未満の料金で利用できます。
ユースケース
エージェント型コーディングと反復的開発 · インタラクティブアプリとコンシューマー向けアプリ
入力
テキスト・画像
出力
テキスト
課金方式
トークン課金
会話を始める
下にメッセージを入力して始めましょう
登録で $0.5 分の無料クレジット。画像を約 20 枚無料生成できます
料金詳細
従量課金の透明な価格設定で、隠れた費用はありません。
料金詳細
使用量ベースの料金内訳
| 仕様 | 価格 | 公式価格 | 節約 |
|---|---|---|---|
| Input/1M tokens | 0.4 クレジット≈$0.4 | 0.5 クレジット | -20% |
| Output/1M tokens | 2.4 クレジット≈$2.4 | 3 クレジット | -20% |
| Cache Read/1M tokens | 0.04 クレジット≈$0.04 | 0.05 クレジット | -20% |
課金ルール
- 出力価格はモデル、解像度、品質、時間、トークン使用量によって変動します。
- アップロードした参照ファイルは、対応モデルでは別途課金される場合があります。
- ウェブ検索や画像検索などの追加機能はリクエストごとに課金される場合があります。
- トークンベースのモデルは入力・出力トークン数で課金されます。
- メインルートが利用できない場合、Velokey は可能な範囲で安定したフォールバックルートに自動的に切り替えることがあります。
- 従量課金制で、クレジットは透明に差し引かれます。
* 最終的な費用は生成結果によって異なります。
関連モデル
同じカテゴリの他のモデルを見る。
- Google20% オフ
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- Google20% オフ
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- Google20% オフ
Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash is Google's most cost-efficient model in the 3 series, with flexible reasoning, multimodal input and a 1M-token context for high-volume, low-latency tasks.
- Google20% オフ
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
手頃な価格のGemini 3 Flash API
VelokeyでGoogleのGemini 3 Flashにアクセスできます。Proグレードの推論、トップクラスのコーディング、マルチモーダル理解をFlashレベルの低レイテンシとコストで提供し、本番アプリ向けに統合エンドポイントと定価未満の料金を利用できます。
Gemini 3 FlashとそのAPIアクセスについて
Gemini 3 Flashは、2025年12月17日にリリースされたGoogle DeepMindのモデルで、Proグレードの推論とFlashレベルの低レイテンシ、効率、コストを組み合わせています。フロンティア級の推論とFlashシリーズの速度を統合し、GPQA Diamondで90.4%、SWE-bench Verifiedで78%(2.5シリーズとGemini 3 Proの両方を上回る)、MMMU Proで81.2%を達成し、Gemini 3 Proに匹敵します。Gemini 2.5 Proより約3倍高速に動作し、一般的なタスクで使用するトークンは約30%少なくなります。 Velokeyは、手頃な価格で統合しやすいGemini 3 Flash APIを提供します。統合チャットエンドポイント、明確なリクエストフロー、コンソールダッシュボードに表示される定価未満の料金により、本番システム、エージェントパイプライン、コンシューマー向けアプリで利用できます。
FlashのコストでProグレードの推論
フロンティア級の推論とFlashシリーズの速度を組み合わせます。GPQA Diamondで90.4%、Humanity's Last Exam(ツールなし)で33.7%を達成し、複数のベンチマークでGemini 2.5 Proを上回ります。すべてFlashレベルの低レイテンシとコストで利用できます。
ドキュメントを見る →
3 Proを上回るトップクラスのコーディング
SWE-bench Verifiedで78%を記録し、Gemini 2.5シリーズとGemini 3 Proの両方を上回ります。エージェント型コーディング、ツール利用、反復的な開発ループに適しています。
ドキュメントを見る →
トークン30%削減で3倍高速
Gemini 2.5 Proより約3倍高速に動作し、一般的なタスクでは平均で約30%少ないトークンを使用します。低レイテンシ・高頻度のワークフロー向けに最適化されています。
ドキュメントを見る →

VelokeyでGemini 3 Flash APIをデプロイする方法
ほんの数ステップで始められます。
サインアップしてAPIキーを取得
Velokeyコンソールにサインインし、Gemini 3 Flashに送信されるすべてのリクエストを認証するAPIキーを生成します。
リクエストパラメーターを設定
modelをgemini-3-flashに設定し、messagesを送信します。マルチモーダルタスクでは画像や動画を追加し、Flashレベルの低レイテンシを活かすためにリクエストを簡潔に保ちます。
統合して呼び出しを開始
Velokeyの統合/v1/chat/completionsエンドポイントにリクエストを送信して、アシスタント、エージェント、インタラクティブアプリを動かします。使用量は1つのコンソールで管理できます。
Gemini 3 Flashの実際のユースケース
エンジニアリングからインタラクティブプロダクトまで、多くの低レイテンシシナリオをカバーします。
エージェント型コーディングと反復的開発
SWE-bench Verifiedで78%、Flashレベルの低レイテンシにより、エージェント型コーディング、迅速な反復、ツールを使用する開発ループに適しています。
迅速な応答を必要とするインタラクティブアプリ
低レイテンシかつ低コストで、高速・高頻度の応答を必要とするインタラクティブアプリに適しています。
リアルタイムのマルチモーダル分析
動画、画像、視覚的Q&Aに対応し、ゲーム支援やデザインの反復などのリアルタイムシナリオに適しています。
複雑な推論タスク
GPQA Diamondで90.4%、Humanity's Last Exam(ツールなし)で33.7%を達成し、難しい科学や推論の問題に適しています。
高頻度ワークフロー
2.5 Proより約3倍高速で、トークンは約30%少なく、スループットが高くコストに敏感なパイプラインに適しています。
コンシューマー向けアプリケーション
Flashレベルの速度とコストにより、多数のユーザーに大規模提供するコンシューマー向けプロダクトに適しています。
Gemini 3 FlashにVelokeyを選ぶ理由
定価からの割引
VelokeyではGemini 3 Flashをより低価格で呼び出せます。強制的なサブスクリプションなしの従量課金で、初期コストを削減します。
統合APIインターフェース
1つのAPIキーでGemini 3 Flashや他のモデルにアクセスできます。複数のアカウントやキーを使い分ける必要がなく、統合が簡単になります。
充実したドキュメントと例
エンドポイントリファレンス、パラメーター詳細、マルチモーダル例により、推論、コーディング、ビジョンをすばやく統合できます。
安定性と高可用性
自動フェイルオーバーと安定したフォールバックルートにより、プライマリルートが停止している場合でも可用性を維持し、本番環境の信頼性を保ちます。
API リファレンス
API 呼び出し例とパラメータの完全な説明
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-flash-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3-flash-preview",
"created": 1234567890,
"data": { ... }
}Gemini 3 Flash API FAQ
Gemini 3 Flashは何が違うのですか?
Proグレードの推論とFlashレベルの低レイテンシ、効率、コストを組み合わせ、フロンティア級の推論とFlashシリーズの速度を両立しています。Gemini 2.5 Proより約3倍高速に動作しながら、GPQA Diamondで90.4%、SWE-bench Verifiedで78%、MMMU Proで81.2%を達成します。
コーディング性能はGemini 3 Proと比べてどうですか?
SWE-bench Verifiedで78%を記録し、Gemini 2.5シリーズとGemini 3 Proの両方を上回ります。はるかに低いレイテンシで、エージェント型コーディングや反復的な開発に強みがあります。
速度と効率はどの程度ですか?
Gemini 2.5 Proより約3倍高速に動作し、一般的なタスクでは平均で約30%少ないトークンを使用します。低レイテンシ・高頻度のワークフロー向けに最適化されています。
どのようなマルチモーダル入力に対応していますか?
動画分析、画像理解、視覚的Q&Aに対応しており、ゲーム支援やデザインの反復などのリアルタイムなマルチモーダルシナリオに適しています。
Velokeyではどのように課金されますか?
入力トークンと出力トークンに基づいて課金され、定価から割引されます。現在のVelokey価格は、このページの料金エリアとコンソールダッシュボードに表示され、強制的なサブスクリプションはありません。