Gemini 3 Flash는 Pro급 추론과 Flash 수준의 지연 시간, 효율성, 비용을 결합한 Google DeepMind의 모델입니다. Velokey의 통합 엔드포인트를 통해 정가보다 낮은 가격으로 이용하세요.
활용 사례
에이전트 코딩 및 반복 개발 · 인터랙티브 및 소비자 앱
입력
텍스트, 이미지
출력
텍스트
청구 방식
토큰당 과금
대화 시작하기
아래에 메시지를 입력해 시작하세요
가입하면 $0.5 무료 크레딧 — 이미지 약 20장을 무료로 생성
요금 상세
사용량 기반의 투명한 가격 정책으로 숨은 비용이 없습니다.
요금 상세
사용량 기반 요금 내역
| 사양 | 가격 | 공식 가격 | 절감 |
|---|---|---|---|
| Input/1M tokens | 0.4 크레딧≈$0.4 | 0.5 크레딧 | -20% |
| Output/1M tokens | 2.4 크레딧≈$2.4 | 3 크레딧 | -20% |
| Cache Read/1M tokens | 0.04 크레딧≈$0.04 | 0.05 크레딧 | -20% |
청구 규칙
- 출력 가격은 모델, 해상도, 품질, 길이 또는 토큰 사용량에 따라 달라집니다.
- 업로드한 참조 파일은 지원되는 경우 별도로 과금될 수 있습니다.
- 웹 검색, 이미지 검색 등 부가 기능은 요청당 과금될 수 있습니다.
- 토큰 기반 모델은 입력 및 출력 토큰 기준으로 과금됩니다.
- 기본 경로를 사용할 수 없는 경우 Velokey가 가능한 범위에서 안정적인 대체 경로로 자동 전환할 수 있습니다.
- 사용량 기반 결제이며 크레딧이 투명하게 차감됩니다.
* 최종 비용은 생성된 결과에 따라 달라집니다.
관련 모델
같은 종류의 다른 모델을 살펴보세요.
- Google20% 할인
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- Google20% 할인
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- Google20% 할인
Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash is Google's most cost-efficient model in the 3 series, with flexible reasoning, multimodal input and a 1M-token context for high-volume, low-latency tasks.
- Google20% 할인
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
합리적인 가격의 Gemini 3 Flash API
Velokey에서 Google의 Gemini 3 Flash를 이용하세요 — Pro급 추론, 최상위 코딩, 멀티모달 이해를 Flash 수준의 지연 시간과 비용으로 제공하며, 프로덕션 앱을 위한 통합 엔드포인트와 정가보다 낮은 가격을 제공합니다.
Gemini 3 Flash와 API 액세스 소개
Gemini 3 Flash는 2025년 12월 17일에 출시된 Google DeepMind의 모델로, Pro급 추론과 Flash 수준의 지연 시간, 효율성, 비용을 결합합니다. 최첨단 추론과 Flash 시리즈의 속도를 결합하여 GPQA Diamond에서 90.4%, SWE-bench Verified에서 78%(2.5 시리즈와 Gemini 3 Pro 모두 능가), MMMU Pro에서 81.2%를 기록하며 Gemini 3 Pro에 필적합니다. Gemini 2.5 Pro보다 약 3x 빠르게 실행되며 일반적인 작업에서 토큰을 약 30% 더 적게 사용합니다. Velokey는 합리적인 가격으로 쉽게 통합할 수 있는 Gemini 3 Flash API를 제공합니다. 통합 채팅 엔드포인트, 명확한 요청 흐름, 그리고 프로덕션 시스템, 에이전트 파이프라인, 소비자 앱을 위해 콘솔 대시보드에 표시되는 정가보다 낮은 가격을 제공합니다.
Flash 비용으로 제공되는 Pro급 추론
최첨단 추론과 Flash 시리즈의 속도를 결합합니다. GPQA Diamond에서 90.4%, Humanity's Last Exam(도구 없음)에서 33.7%를 달성하여 여러 벤치마크에서 Gemini 2.5 Pro를 능가합니다 — 모두 Flash 수준의 지연 시간과 비용으로 제공됩니다.
문서 보기 →
3 Pro를 능가하는 최상위 코딩
SWE-bench Verified에서 78%를 기록하여 Gemini 2.5 시리즈와 Gemini 3 Pro 모두를 능가합니다 — 에이전트 코딩, 도구 사용, 반복 개발 루프에 적합합니다.
문서 보기 →
30% 더 적은 토큰으로 3x 더 빠름
Gemini 2.5 Pro보다 약 3x 빠르게 실행되고 일반적인 작업에서 평균적으로 토큰을 약 30% 더 적게 사용하여, 저지연 고빈도 워크플로에 최적화되어 있습니다.
문서 보기 →

Velokey에서 Gemini 3 Flash API 배포하는 방법
몇 가지 단계만으로 시작하세요.
가입하고 API 키 받기
Velokey 콘솔에 로그인하여 Gemini 3 Flash로 보내는 모든 요청을 인증하는 API 키를 생성하세요.
요청 매개변수 구성
model을 gemini-3-flash로 설정하고 메시지를 제출하세요. 멀티모달 작업을 위해 이미지나 동영상을 추가하고, Flash 수준의 지연 시간 이점을 얻을 수 있도록 요청을 간결하게 유지하세요.
통합하고 호출 시작
Velokey의 통합 /v1/chat/completions 엔드포인트로 요청을 보내 어시스턴트, 에이전트, 인터랙티브 앱을 구동하고, 사용량을 하나의 콘솔에서 관리하세요.
Gemini 3 Flash의 실제 사용 사례
엔지니어링부터 인터랙티브 제품까지, 다양한 저지연 시나리오를 포괄합니다.
에이전트 코딩 및 반복 개발
Flash 수준의 지연 시간과 SWE-bench Verified 78% — 에이전트 코딩, 빠른 반복, 도구 사용 개발 루프에 적합합니다.
빠른 응답이 필요한 인터랙티브 앱
낮은 지연 시간과 낮은 비용 — 빠른 고빈도 응답이 필요한 인터랙티브 앱에 적합합니다.
실시간 멀티모달 분석
동영상, 이미지, 시각적 Q&A — 게임 지원 및 디자인 반복과 같은 실시간 시나리오에 적합합니다.
복잡한 추론 작업
GPQA Diamond 90.4% 및 Humanity's Last Exam(도구 없음) 33.7% — 어려운 과학 및 추론 문제에 적합합니다.
고빈도 워크플로
2.5 Pro보다 약 3x 빠르고 토큰은 ~30% 더 적음 — 고처리량, 비용 민감형 파이프라인에 적합합니다.
소비자 애플리케이션
Flash 수준의 속도와 비용 — 대규모로 많은 사용자에게 서비스를 제공하는 소비자 제품에 적합합니다.
Gemini 3 Flash에 Velokey를 선택해야 하는 이유
정가 할인
Velokey에서 더 낮은 가격으로 Gemini 3 Flash를 호출하세요 — 강제 구독 없이 사용한 만큼 지불하여 초기 비용을 줄일 수 있습니다.
통합 API 인터페이스
하나의 API 키로 Gemini 3 Flash와 다른 모델에 액세스하세요 — 여러 계정과 키를 관리할 필요가 없어 통합이 간소화됩니다.
완전한 문서와 예제
엔드포인트 참조, 매개변수 세부 정보, 멀티모달 예제가 추론, 코딩, 비전을 빠르게 통합할 수 있도록 도와줍니다.
안정적이고 높은 가용성
자동 장애 조치와 안정적인 대체 경로가 기본 경로 다운 시에도 가용성을 유지하여 프로덕션 안정성을 보장합니다.
API 레퍼런스
완전한 API 호출 예시와 파라미터 설명
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-flash-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3-flash-preview",
"created": 1234567890,
"data": { ... }
}Gemini 3 Flash API FAQ
Gemini 3 Flash는 무엇이 다른가요?
Pro급 추론과 Flash 수준의 지연 시간, 효율성, 비용을 결합하여 최첨단 추론과 Flash 시리즈의 속도를 함께 제공합니다. Gemini 2.5 Pro보다 약 3x 빠르게 실행되면서 GPQA Diamond에서 90.4%, SWE-bench Verified에서 78%, MMMU Pro에서 81.2%를 달성합니다.
코딩 성능은 Gemini 3 Pro와 비교해 어떤가요?
SWE-bench Verified에서 78%를 기록하여 Gemini 2.5 시리즈와 Gemini 3 Pro 모두를 능가합니다 — 훨씬 낮은 지연 시간으로 에이전트 코딩과 반복 개발에 강력합니다.
속도와 효율성은 어느 정도인가요?
Gemini 2.5 Pro보다 약 3x 빠르게 실행되며, 일반적인 작업에서 평균적으로 토큰을 약 30% 더 적게 사용하므로 저지연 고빈도 워크플로에 최적화되어 있습니다.
어떤 멀티모달 입력을 지원하나요?
동영상 분석, 이미지 이해, 시각적 Q&A를 지원하며, 게임 지원 및 디자인 반복과 같은 실시간 멀티모달 시나리오에 적합합니다.
Velokey에서는 어떻게 과금되나요?
입력 및 출력 토큰 기준으로 과금되며 정가 대비 할인이 적용됩니다. 현재 Velokey 가격은 이 페이지의 가격 영역과 콘솔 대시보드에 표시되며, 강제 구독은 없습니다.