Gemini 3.1 Flash는 Google의 가장 비용 효율적인 Gemini 3 모델(프리뷰)로, 강력한 지능, 높은 처리량, 멀티모달 입력을 제공합니다. Velokey의 통합 엔드포인트를 통해 정가보다 낮은 가격으로 이용하세요.
활용 사례
코딩 및 UI 생성 · 대규모 번역 및 데이터 라벨링
입력
텍스트, 이미지
출력
텍스트
청구 방식
토큰당 과금
대화 시작하기
아래에 메시지를 입력해 시작하세요
가입하면 $0.5 무료 크레딧 — 이미지 약 20장을 무료로 생성
요금 상세
사용량 기반의 투명한 가격 정책으로 숨은 비용이 없습니다.
요금 상세
사용량 기반 요금 내역
| 사양 | 가격 | 공식 가격 | 절감 |
|---|---|---|---|
| Input/1M tokens | 0.2 크레딧≈$0.2 | 0.25 크레딧 | -20% |
| Output/1M tokens | 1.2 크레딧≈$1.2 | 1.5 크레딧 | -20% |
| Cache Read/1M tokens | 0.02 크레딧≈$0.02 | 0.025 크레딧 | -20% |
청구 규칙
- 출력 가격은 모델, 해상도, 품질, 길이 또는 토큰 사용량에 따라 달라집니다.
- 업로드한 참조 파일은 지원되는 경우 별도로 과금될 수 있습니다.
- 웹 검색, 이미지 검색 등 부가 기능은 요청당 과금될 수 있습니다.
- 토큰 기반 모델은 입력 및 출력 토큰 기준으로 과금됩니다.
- 기본 경로를 사용할 수 없는 경우 Velokey가 가능한 범위에서 안정적인 대체 경로로 자동 전환할 수 있습니다.
- 사용량 기반 결제이며 크레딧이 투명하게 차감됩니다.
* 최종 비용은 생성된 결과에 따라 달라집니다.
관련 모델
같은 종류의 다른 모델을 살펴보세요.
- Google20% 할인
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- Google20% 할인
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- Google20% 할인
Gemini 3 Flash Preview
Gemini 3 Flash brings Pro-grade reasoning at Flash-level latency and cost — strong coding (SWE-bench 78%), 3x faster than 2.5 Pro, and multimodal understanding.
- Google20% 할인
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
합리적인 가격의 Gemini 3.1 Flash API
Velokey에서 Google DeepMind의 가장 비용 효율적인 Gemini 3 모델을 이용하세요. 높은 처리량, 유연한 추론 수준, 1M 토큰 멀티모달 입력을 제공하며, 프로덕션 앱을 위한 통합 엔드포인트와 정가보다 낮은 가격을 제공합니다.
Gemini 3.1 Flash와 API 액세스 소개
Gemini 3.1 Flash는 Gemini 3 시리즈(프리뷰)에서 Google DeepMind의 가장 비용 효율적인 모델입니다. 363 토큰/초의 높은 처리량과 낮은 지연 시간에 강력한 지능을 결합하고, 각 작업의 복잡도에 맞게 컴퓨팅을 조정할 수 있는 유연한 추론 수준을 추가하며, 함수 호출, 구조화된 출력, 검색 기반 그라운딩, 코드 실행과 함께 1M 토큰 컨텍스트 창에서 텍스트, 이미지, 비디오, 오디오, PDF 등 멀티모달 입력을 지원합니다. GPQA Diamond, MMMU-Pro, 코드 생성에서 Gemini 2.5 Flash보다 뛰어난 성능을 보입니다. Velokey는 합리적인 가격으로 쉽게 통합할 수 있는 Gemini 3.1 Flash API를 제공합니다. 통합 채팅 엔드포인트, 명확한 요청 흐름, 프로덕션 시스템, 대량 파이프라인, 실시간 애플리케이션을 위한 정가보다 낮은 가격을 제공합니다.
Gemini 3 시리즈에서 가장 비용 효율적
Gemini 3 시리즈에서 가장 비용 효율적인 모델로, 강력한 지능과 낮은 가격을 결합해 대량 워크로드가 품질을 포기하지 않고도 합리적인 비용을 유지할 수 있습니다.
문서 보기 →
높은 속도와 낮은 지연 시간
낮은 지연 시간으로 약 363 토큰/초를 생성하여 대량 및 지연 시간에 민감한 작업이 빠르게 응답하도록 유지합니다. 대규모 실시간 콘텐츠 생성에 이상적입니다.
문서 보기 →
유연한 추론 수준
각 요청의 추론 깊이를 높이거나 낮춰 다양한 작업 복잡도에 맞출 수 있습니다. 간단한 작업에는 저렴하고 즉각적으로, 작업에 정말 필요할 때는 더 깊게 처리할 수 있습니다.
문서 보기 →
도구가 포함된 1M 토큰 멀티모달 입력
1M 토큰 입력 컨텍스트에서 텍스트, 이미지, 비디오, 오디오, PDF를 지원하며, 실제 에이전트 워크플로를 위한 함수 호출, 구조화된 출력, 검색 기반 그라운딩, 코드 실행을 제공합니다.
문서 보기 →
Velokey에서 Gemini 3.1 Flash API 배포 방법
몇 가지 단계만으로 시작하세요.
가입하고 API Key 받기
Velokey 콘솔에 로그인하여 gemini-3-1-flash로 전송되는 모든 요청을 인증하는 API Key를 생성하세요.
요청 매개변수 설정
모델을 gemini-3-1-flash로 설정하고 메시지를 제출하세요. 깊이와 속도의 균형을 맞추기 위해 유연한 추론 수준을 선택하고, 필요에 따라 텍스트, 이미지, 비디오, 오디오 또는 PDF 입력을 첨부하세요.
통합하고 호출 시작
Velokey의 통합 /v1/chat/completions 엔드포인트로 요청을 보내 어시스턴트, 대량 파이프라인, 실시간 앱을 구동하고, 사용량은 하나의 콘솔에서 관리하세요.
Gemini 3.1 Flash의 실제 사용 사례
코딩부터 대규모 데이터 작업까지, 다양한 대량 시나리오를 포괄합니다.
코딩 및 UI 생성
낮은 지연 시간과 강력한 코드 생성 품질을 제공하여, 속도와 비용이 모두 중요한 대규모 코딩 어시스턴트 및 UI 생성에 적합합니다.
대규모 번역
비용 효율적이고 빠르므로, 대량 콘텐츠 배치를 지속적으로 처리하는 대규모 번역 파이프라인에 적합합니다.
대규모 데이터 라벨링
낮은 호출당 비용과 높은 처리량을 제공하여, 장기 실행 작업 전반에서 대규모 데이터셋을 라벨링하고 주석 처리하는 데 적합합니다.
실시간 콘텐츠 생성
낮은 지연 시간으로 363 토큰/초를 제공하여, 라이브 제품과 인터랙티브 경험에서 실시간 콘텐츠 생성에 적합합니다.
지연 시간에 민감한 추론
유연한 추론 수준을 통해 필요할 때는 추론을 수행하면서도 응답을 빠르게 유지할 수 있어, 지연 시간에 민감한 어시스턴트에 적합합니다.
멀티모달 이해
1M 토큰 컨텍스트에서 텍스트, 이미지, 비디오, 오디오, PDF 입력을 처리하므로, 혼합 미디어 콘텐츠 분석 및 요약에 적합합니다.
Gemini 3.1 Flash에 Velokey를 선택해야 하는 이유
정가 대비 할인
Velokey에서 Gemini 3.1 Flash를 더 낮은 가격으로 호출하세요. 강제 구독 없이 사용한 만큼 지불하여 대량 워크로드를 합리적인 비용으로 유지할 수 있습니다.
통합 API 인터페이스
하나의 API Key로 Gemini 3.1 Flash와 다른 모델에 액세스할 수 있습니다. 여러 계정과 키를 오갈 필요가 없어 통합이 간소화됩니다.
완전한 문서와 통합 가이드
엔드포인트 참조, 매개변수 세부 정보, 예제를 통해 추론 수준, 멀티모달 입력, 도구 사용을 빠르게 연결할 수 있습니다.
안정적이고 높은 가용성
자동 장애 조치와 안정적인 대체 경로가 기본 경로 다운 시에도 가용성을 유지하여 프로덕션 안정성을 보장합니다.
API 레퍼런스
완전한 API 호출 예시와 파라미터 설명
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3.1-flash-lite-preview",
"created": 1234567890,
"data": { ... }
}Gemini 3.1 Flash API FAQ
Gemini 3.1 Flash는 무엇에 가장 적합한가요?
Gemini 3 시리즈(프리뷰)에서 가장 비용 효율적인 모델로, 효율성과 지능이 모두 필요한 대량 작업을 위해 설계되었습니다. 코딩 및 UI 생성, 번역, 대규모 데이터 라벨링, 실시간 콘텐츠 생성, 지연 시간에 민감한 추론에 적합합니다.
얼마나 빠른가요?
낮은 지연 시간으로 약 363 토큰/초를 생성하므로 대량 및 지연 시간에 민감한 워크로드에 매우 적합합니다. 유연한 추론 수준을 통해 작업별로 깊이와 속도를 조절할 수 있습니다.
어떤 입력과 도구를 지원하나요?
텍스트, 이미지, 비디오, 오디오, PDF 등 멀티모달 입력을 지원하며, 1M 토큰 입력 컨텍스트와 64K 출력에서 텍스트 출력을 제공합니다. 도구 사용에는 함수 호출, 구조화된 출력, 검색 기반 그라운딩, 코드 실행이 포함됩니다. 지식 기준일은 2025년 1월입니다.
Gemini 2.5 Flash와 비교하면 어떤가요?
핵심 벤치마크에서 Gemini 2.5 Flash를 능가하며, GPQA Diamond에서 86.9%, MMMU-Pro에서 76.8%, 코드 생성에서 72.0%를 달성합니다.
Velokey에서는 어떻게 과금되나요?
이 페이지의 가격 영역에는 현재 Velokey 가격이 표시되며, 입력 및 출력 토큰 기준으로 과금되고 정가 대비 할인이 적용됩니다. 하나의 API 키로 Gemini 3.1 Flash와 다른 모델을 함께 사용할 수 있습니다.