Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash — самая экономичная модель Gemini 3 от Google (preview) с сильным интеллектом, высокой пропускной способностью и мультимодальным вводом. Получайте доступ к ней через единый endpoint Velokey по цене ниже прайс-листа.
Сценарии использования
Программирование и генерация UI · Перевод и разметка данных в масштабе
Ввод
Текст, изображение
Вывод
Текст
Тарификация
За токены
Начать разговор
Введите сообщение ниже, чтобы начать
Зарегистрируйтесь и получите $0.5 бесплатных кредитов — около 20 бесплатных изображений
Детали цены
Прозрачные цены по факту использования, без скрытых платежей.
Подробные цены
Детализация цен по использованию
| Спецификация | Цена | Официальная | Экономия |
|---|---|---|---|
| Input/1M tokens | 0.2 кредитов≈$0.2 | 0.25 кредитов | -20% |
| Output/1M tokens | 1.2 кредитов≈$1.2 | 1.5 кредитов | -20% |
| Cache Read/1M tokens | 0.02 кредитов≈$0.02 | 0.025 кредитов | -20% |
Правила тарификации
- Цена вывода зависит от модели, разрешения, качества, длительности или расхода токенов.
- Загруженные референс-файлы могут тарифицироваться отдельно, если модель их поддерживает.
- Дополнительные возможности, такие как веб-поиск или поиск по изображениям, могут тарифицироваться за запрос.
- Токеновые модели тарифицируются по входным и выходным токенам.
- Если основной маршрут недоступен, Velokey может автоматически переключиться на стабильный резервный маршрут, когда это возможно.
- Оплата по мере использования с прозрачным списанием кредитов.
* Итоговая стоимость зависит от сгенерированного результата.
Похожие модели
Изучите другие модели того же типа.
- GoogleСэкономьте 20%
Gemini 3.1 Pro Preview
Gemini 3.1 Pro delivers reasoning with unprecedented depth, top-tier agentic coding, and multimodal understanding of text, image, audio, video and PDF over a 1M-token context.
- GoogleСэкономьте 20%
Gemini 3 Pro Preview
Gemini 3 Pro is Google's state-of-the-art multimodal reasoning model with agentic coding, a 1M-token context, and a Deep Think mode for the hardest problems.
- GoogleСэкономьте 20%
Gemini 3 Flash Preview
Gemini 3 Flash brings Pro-grade reasoning at Flash-level latency and cost — strong coding (SWE-bench 78%), 3x faster than 2.5 Pro, and multimodal understanding.
- GoogleСэкономьте 20%
Gemini 3.5 Flash
Google's high-performance dialogue model is fast and highly accurate, ideal for text generation, Q&A, and multi-turn conversations.
Доступный API Gemini 3.1 Flash
Получайте доступ к самой экономичной модели Gemini 3 от Google DeepMind на Velokey — высокая пропускная способность, гибкие уровни рассуждения и мультимодальный ввод на 1M токенов, с единым endpoint и ценой ниже прайс-листа для продакшн-приложений.
Знакомьтесь с Gemini 3.1 Flash и доступом к её API
Gemini 3.1 Flash — самая экономичная модель Google DeepMind в серии Gemini 3 (preview). Она сочетает сильный интеллект с высокой пропускной способностью 363 токена/секунду и низкой задержкой, добавляет гибкие уровни рассуждения, чтобы вы могли сопоставлять вычисления со сложностью каждой задачи, и принимает мультимодальный ввод — текст, изображения, видео, аудио и PDF — в контекстном окне на 1M токенов с function calling, structured output, search grounding и code execution. Она превосходит Gemini 2.5 Flash в GPQA Diamond, MMMU-Pro и генерации кода. Velokey предоставляет доступный и простой для интеграции API Gemini 3.1 Flash: единый chat endpoint, понятный поток запросов и цены ниже прайс-листа для продакшн-систем, высоконагруженных конвейеров и приложений реального времени.
Самая экономичная в серии Gemini 3
Самая экономичная модель в серии Gemini 3, сочетающая сильный интеллект с низкой ценой, чтобы высоконагруженные рабочие процессы оставались доступными без потери качества.
Посмотреть документацию →
Высокая скорость и низкая задержка
Генерирует около 363 токенов/секунду с низкой задержкой, сохраняя отзывчивость высоконагруженных и чувствительных к задержке задач — идеально для генерации контента в реальном времени в масштабе.
Посмотреть документацию →
Гибкие уровни рассуждения
Повышайте или снижайте глубину рассуждения для каждого запроса, чтобы соответствовать переменной сложности задач — дёшево и мгновенно для простой работы, глубже, когда задача действительно этого требует.
Посмотреть документацию →
Мультимодальный ввод на 1M токенов с инструментами
Принимает текст, изображения, видео, аудио и PDF в контексте ввода на 1M токенов, с function calling, structured output, search grounding и code execution для реальных агентных рабочих процессов.
Посмотреть документацию →
Как развернуть API Gemini 3.1 Flash на Velokey
Начните всего за несколько шагов.
Зарегистрируйтесь и получите API Key
Войдите в консоль Velokey, чтобы создать API Key, который аутентифицирует каждый запрос, отправленный в gemini-3-1-flash.
Настройте параметры запроса
Установите model в gemini-3-1-flash и отправьте messages. Выберите гибкий уровень рассуждения, чтобы сбалансировать глубину и скорость, и при необходимости прикрепите текст, изображение, видео, аудио или PDF.
Интегрируйте и начинайте вызывать
Отправляйте запросы в единый endpoint Velokey /v1/chat/completions, чтобы обеспечивать работу ассистентов, высоконагруженных конвейеров и приложений реального времени, с управлением использованием в одной консоли.
Реальные сценарии использования Gemini 3.1 Flash
От программирования до работы с данными в большом масштабе — покрывает множество высоконагруженных сценариев.
Программирование и генерация UI
Сильное качество генерации кода с низкой задержкой — подходит для ассистентов по программированию и генерации UI в масштабе, где важны и скорость, и стоимость.
Перевод в масштабе
Экономичная и быстрая — подходит для высоконагруженных конвейеров перевода, которые непрерывно обрабатывают большие пакеты контента.
Разметка данных в масштабе
Низкая стоимость вызова и высокая пропускная способность — подходит для разметки и аннотирования больших наборов данных в длительных задачах.
Генерация контента в реальном времени
363 токена/секунду с низкой задержкой — подходит для генерации контента в реальном времени в live-продуктах и интерактивных сценариях.
Рассуждение, чувствительное к задержке
Гибкие уровни рассуждения позволяют сохранять быстрые ответы и при этом рассуждать, когда это нужно, — подходит для ассистентов, чувствительных к задержке.
Мультимодальное понимание
Принимает текст, изображения, видео, аудио и PDF в контексте на 1M токенов — подходит для анализа и резюмирования смешанного медиаконтента.
Почему стоит выбрать Velokey для Gemini 3.1 Flash
Скидка от прайс-листа
Вызывайте Gemini 3.1 Flash по более низкой цене на Velokey — оплата по мере использования без принудительной подписки, что сохраняет доступность высоконагруженных рабочих процессов.
Единый интерфейс API
Один API Key открывает доступ к Gemini 3.1 Flash и другим моделям — без необходимости управлять несколькими аккаунтами и ключами, что упрощает интеграцию.
Полная документация и руководство по интеграции
Справочники по endpoint, детали параметров и примеры помогают быстро настроить уровни рассуждения, мультимодальный ввод и использование инструментов.
Стабильность и высокая доступность
Автоматическое переключение при сбоях и стабильные резервные маршруты поддерживают доступность, когда основной маршрут недоступен, сохраняя надёжность продакшена.
Справочник API
Полные примеры вызовов API и описание параметров
Endpoint
https://api.velokey.ai/v1beta/models/{model}:generateContentAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite-preview",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "gemini-3.1-flash-lite-preview",
"created": 1234567890,
"data": { ... }
}FAQ по API Gemini 3.1 Flash
Для чего лучше всего подходит Gemini 3.1 Flash?
Это самая экономичная модель в серии Gemini 3 (preview), созданная для высоконагруженных задач, которым нужны эффективность и интеллект: программирование и генерация UI, перевод, разметка данных в масштабе, генерация контента в реальном времени и рассуждение с низкой задержкой.
Насколько она быстрая?
Она генерирует около 363 токенов/секунду с низкой задержкой, что делает её хорошо подходящей для высоконагруженных и чувствительных к задержке рабочих процессов. Гибкие уровни рассуждения позволяют для каждой задачи обменивать глубину на скорость.
Какие входные данные и инструменты она поддерживает?
Мультимодальный ввод — текст, изображения, видео, аудио и PDF — с текстовым выводом, в контексте ввода на 1M токенов и выводом 64K. Использование инструментов включает function calling, structured output, search grounding и code execution. Срез знаний — January 2025.
Как она сравнивается с Gemini 2.5 Flash?
Она превосходит Gemini 2.5 Flash в ключевых бенчмарках, достигая 86.9% на GPQA Diamond, 76.8% на MMMU-Pro и 72.0% в генерации кода.
Как тарифицируется на Velokey?
Раздел цен на этой странице показывает текущую цену Velokey, тарифицируемую по входным и выходным токенам со скидкой от прайс-листа. Один API key покрывает Gemini 3.1 Flash вместе с другими моделями.
Начните работать с Gemini 3.1 Flash Lite Preview уже сегодня
Один API-ключ — доступ к недорогим и стабильным ИИ-моделям через Velokey.