Velokey

Gemini 3.1 Flash Lite Preview

GoogleЧатвход 0.2 · выход 1.2 кредитов / 1M токенов≈$0.2 / $1.2Доступно

Gemini 3.1 Flash — самая экономичная модель Gemini 3 от Google (preview) с сильным интеллектом, высокой пропускной способностью и мультимодальным вводом. Получайте доступ к ней через единый endpoint Velokey по цене ниже прайс-листа.

Самая экономичная в Gemini 3363 токена/секундуГибкие уровни рассужденияМультимодальный ввод на 1M токенов

Сценарии использования

Программирование и генерация UI · Перевод и разметка данных в масштабе

Ввод

Текст, изображение

Вывод

Текст

Тарификация

За токены

0.7
02
2048
2568192
gemini-3.1-flash-lite-preview

Начать разговор

Введите сообщение ниже, чтобы начать

Зарегистрируйтесь и получите $0.5 бесплатных кредитов — около 20 бесплатных изображений

Детали цены

Прозрачные цены по факту использования, без скрытых платежей.

Подробные цены

Детализация цен по использованию

СпецификацияЦенаОфициальнаяЭкономия
Input/1M tokens0.2 кредитов≈$0.20.25 кредитов-20%
Output/1M tokens1.2 кредитов≈$1.21.5 кредитов-20%
Cache Read/1M tokens0.02 кредитов≈$0.020.025 кредитов-20%

Правила тарификации

  • Цена вывода зависит от модели, разрешения, качества, длительности или расхода токенов.
  • Загруженные референс-файлы могут тарифицироваться отдельно, если модель их поддерживает.
  • Дополнительные возможности, такие как веб-поиск или поиск по изображениям, могут тарифицироваться за запрос.
  • Токеновые модели тарифицируются по входным и выходным токенам.
  • Если основной маршрут недоступен, Velokey может автоматически переключиться на стабильный резервный маршрут, когда это возможно.
  • Оплата по мере использования с прозрачным списанием кредитов.

* Итоговая стоимость зависит от сгенерированного результата.

Доступный API Gemini 3.1 Flash

Получайте доступ к самой экономичной модели Gemini 3 от Google DeepMind на Velokey — высокая пропускная способность, гибкие уровни рассуждения и мультимодальный ввод на 1M токенов, с единым endpoint и ценой ниже прайс-листа для продакшн-приложений.

Знакомьтесь с Gemini 3.1 Flash и доступом к её API

Gemini 3.1 Flash — самая экономичная модель Google DeepMind в серии Gemini 3 (preview). Она сочетает сильный интеллект с высокой пропускной способностью 363 токена/секунду и низкой задержкой, добавляет гибкие уровни рассуждения, чтобы вы могли сопоставлять вычисления со сложностью каждой задачи, и принимает мультимодальный ввод — текст, изображения, видео, аудио и PDF — в контекстном окне на 1M токенов с function calling, structured output, search grounding и code execution. Она превосходит Gemini 2.5 Flash в GPQA Diamond, MMMU-Pro и генерации кода. Velokey предоставляет доступный и простой для интеграции API Gemini 3.1 Flash: единый chat endpoint, понятный поток запросов и цены ниже прайс-листа для продакшн-систем, высоконагруженных конвейеров и приложений реального времени.

Самая экономичная в серии Gemini 3

Самая экономичная модель в серии Gemini 3, сочетающая сильный интеллект с низкой ценой, чтобы высоконагруженные рабочие процессы оставались доступными без потери качества.

Посмотреть документацию
Самая экономичная в серии Gemini 3

Высокая скорость и низкая задержка

Генерирует около 363 токенов/секунду с низкой задержкой, сохраняя отзывчивость высоконагруженных и чувствительных к задержке задач — идеально для генерации контента в реальном времени в масштабе.

Посмотреть документацию
Высокая скорость и низкая задержка

Гибкие уровни рассуждения

Повышайте или снижайте глубину рассуждения для каждого запроса, чтобы соответствовать переменной сложности задач — дёшево и мгновенно для простой работы, глубже, когда задача действительно этого требует.

Посмотреть документацию
Гибкие уровни рассуждения

Мультимодальный ввод на 1M токенов с инструментами

Принимает текст, изображения, видео, аудио и PDF в контексте ввода на 1M токенов, с function calling, structured output, search grounding и code execution для реальных агентных рабочих процессов.

Посмотреть документацию
Мультимодальный ввод на 1M токенов с инструментами

Как развернуть API Gemini 3.1 Flash на Velokey

Начните всего за несколько шагов.

1

Зарегистрируйтесь и получите API Key

Войдите в консоль Velokey, чтобы создать API Key, который аутентифицирует каждый запрос, отправленный в gemini-3-1-flash.

2

Настройте параметры запроса

Установите model в gemini-3-1-flash и отправьте messages. Выберите гибкий уровень рассуждения, чтобы сбалансировать глубину и скорость, и при необходимости прикрепите текст, изображение, видео, аудио или PDF.

3

Интегрируйте и начинайте вызывать

Отправляйте запросы в единый endpoint Velokey /v1/chat/completions, чтобы обеспечивать работу ассистентов, высоконагруженных конвейеров и приложений реального времени, с управлением использованием в одной консоли.

Реальные сценарии использования Gemini 3.1 Flash

От программирования до работы с данными в большом масштабе — покрывает множество высоконагруженных сценариев.

Программирование и генерация UI

Сильное качество генерации кода с низкой задержкой — подходит для ассистентов по программированию и генерации UI в масштабе, где важны и скорость, и стоимость.

Перевод в масштабе

Экономичная и быстрая — подходит для высоконагруженных конвейеров перевода, которые непрерывно обрабатывают большие пакеты контента.

Разметка данных в масштабе

Низкая стоимость вызова и высокая пропускная способность — подходит для разметки и аннотирования больших наборов данных в длительных задачах.

Генерация контента в реальном времени

363 токена/секунду с низкой задержкой — подходит для генерации контента в реальном времени в live-продуктах и интерактивных сценариях.

Рассуждение, чувствительное к задержке

Гибкие уровни рассуждения позволяют сохранять быстрые ответы и при этом рассуждать, когда это нужно, — подходит для ассистентов, чувствительных к задержке.

Мультимодальное понимание

Принимает текст, изображения, видео, аудио и PDF в контексте на 1M токенов — подходит для анализа и резюмирования смешанного медиаконтента.

Почему стоит выбрать Velokey для Gemini 3.1 Flash

Скидка от прайс-листа

Вызывайте Gemini 3.1 Flash по более низкой цене на Velokey — оплата по мере использования без принудительной подписки, что сохраняет доступность высоконагруженных рабочих процессов.

Единый интерфейс API

Один API Key открывает доступ к Gemini 3.1 Flash и другим моделям — без необходимости управлять несколькими аккаунтами и ключами, что упрощает интеграцию.

Полная документация и руководство по интеграции

Справочники по endpoint, детали параметров и примеры помогают быстро настроить уровни рассуждения, мультимодальный ввод и использование инструментов.

Стабильность и высокая доступность

Автоматическое переключение при сбоях и стабильные резервные маршруты поддерживают доступность, когда основной маршрут недоступен, сохраняя надёжность продакшена.

Справочник API

Полные примеры вызовов API и описание параметров

Endpoint

https://api.velokey.ai/v1beta/models/{model}:generateContent

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-lite-preview",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "gemini-3.1-flash-lite-preview",
  "created": 1234567890,
  "data": { ... }
}

FAQ по API Gemini 3.1 Flash

Для чего лучше всего подходит Gemini 3.1 Flash?

Это самая экономичная модель в серии Gemini 3 (preview), созданная для высоконагруженных задач, которым нужны эффективность и интеллект: программирование и генерация UI, перевод, разметка данных в масштабе, генерация контента в реальном времени и рассуждение с низкой задержкой.

Насколько она быстрая?

Она генерирует около 363 токенов/секунду с низкой задержкой, что делает её хорошо подходящей для высоконагруженных и чувствительных к задержке рабочих процессов. Гибкие уровни рассуждения позволяют для каждой задачи обменивать глубину на скорость.

Какие входные данные и инструменты она поддерживает?

Мультимодальный ввод — текст, изображения, видео, аудио и PDF — с текстовым выводом, в контексте ввода на 1M токенов и выводом 64K. Использование инструментов включает function calling, structured output, search grounding и code execution. Срез знаний — January 2025.

Как она сравнивается с Gemini 2.5 Flash?

Она превосходит Gemini 2.5 Flash в ключевых бенчмарках, достигая 86.9% на GPQA Diamond, 76.8% на MMMU-Pro и 72.0% в генерации кода.

Как тарифицируется на Velokey?

Раздел цен на этой странице показывает текущую цену Velokey, тарифицируемую по входным и выходным токенам со скидкой от прайс-листа. Один API key покрывает Gemini 3.1 Flash вместе с другими моделями.

Начните работать с Gemini 3.1 Flash Lite Preview уже сегодня

Один API-ключ — доступ к недорогим и стабильным ИИ-моделям через Velokey.