Velokey

Gemini 3 Flash Preview

GoogleЧатвход 0.4 · выход 2.4 кредитов / 1M токенов≈$0.4 / $2.4Доступно

Gemini 3 Flash — модель Google DeepMind, сочетающая рассуждения уровня Pro с задержкой, эффективностью и стоимостью уровня Flash. Получайте доступ через единый endpoint Velokey по цене ниже прейскурантной.

Рассуждения уровня ProSWE-bench 78%В 3x быстрее, чем 2.5 ProМультимодальные изображения и видео

Сценарии использования

Агентный кодинг и итеративная разработка · Интерактивные и потребительские приложения

Ввод

Текст, изображение

Вывод

Текст

Тарификация

За токены

0.7
02
2048
2568192
gemini-3-flash-preview

Начать разговор

Введите сообщение ниже, чтобы начать

Зарегистрируйтесь и получите $0.5 бесплатных кредитов — около 20 бесплатных изображений

Детали цены

Прозрачные цены по факту использования, без скрытых платежей.

Подробные цены

Детализация цен по использованию

СпецификацияЦенаОфициальнаяЭкономия
Input/1M tokens0.4 кредитов≈$0.40.5 кредитов-20%
Output/1M tokens2.4 кредитов≈$2.43 кредитов-20%
Cache Read/1M tokens0.04 кредитов≈$0.040.05 кредитов-20%

Правила тарификации

  • Цена вывода зависит от модели, разрешения, качества, длительности или расхода токенов.
  • Загруженные референс-файлы могут тарифицироваться отдельно, если модель их поддерживает.
  • Дополнительные возможности, такие как веб-поиск или поиск по изображениям, могут тарифицироваться за запрос.
  • Токеновые модели тарифицируются по входным и выходным токенам.
  • Если основной маршрут недоступен, Velokey может автоматически переключиться на стабильный резервный маршрут, когда это возможно.
  • Оплата по мере использования с прозрачным списанием кредитов.

* Итоговая стоимость зависит от сгенерированного результата.

Доступный Gemini 3 Flash API

Получайте доступ к Gemini 3 Flash от Google на Velokey — рассуждения уровня Pro, кодинг высшего уровня и мультимодальное понимание с задержкой и стоимостью уровня Flash, через единый endpoint и по цене ниже прейскурантной для production-приложений.

Познакомьтесь с Gemini 3 Flash и доступом к ее API

Gemini 3 Flash — модель Google DeepMind, выпущенная 17 декабря 2025, сочетающая рассуждения уровня Pro с задержкой, эффективностью и стоимостью уровня Flash. Она объединяет передовые рассуждения со скоростью серии Flash — 90.4% на GPQA Diamond, 78% на SWE-bench Verified (превосходит как серию 2.5, так и Gemini 3 Pro) и 81.2% на MMMU Pro, сопоставимо с Gemini 3 Pro. Она работает примерно в 3x быстрее, чем Gemini 2.5 Pro, и использует примерно на 30% меньше токенов в типичных задачах. Velokey предоставляет доступный и простой для интеграции Gemini 3 Flash API: единый chat endpoint, понятный процесс запросов и цену ниже прейскурантной, отображаемую в панели вашей консоли, для production-систем, агентных пайплайнов и потребительских приложений.

Рассуждения уровня Pro по стоимости Flash

Объединяет передовые рассуждения со скоростью серии Flash: 90.4% на GPQA Diamond и 33.7% на Humanity's Last Exam (без инструментов), превосходя Gemini 2.5 Pro по нескольким бенчмаркам — все это с задержкой и стоимостью уровня Flash.

Смотреть документацию
Рассуждения уровня Pro по стоимости Flash

Кодинг высшего уровня, превосходящий 3 Pro

Набирает 78% на SWE-bench Verified, превосходя как серию Gemini 2.5, так и Gemini 3 Pro — подходит для агентного кодинга, использования инструментов и итеративных циклов разработки.

Смотреть документацию
Кодинг высшего уровня, превосходящий 3 Pro

В 3x быстрее при на 30% меньшем числе токенов

Работает примерно в 3x быстрее, чем Gemini 2.5 Pro, и использует в среднем примерно на 30% меньше токенов для типичных задач, оптимизирована для низколатентных высокочастотных рабочих процессов.

Смотреть документацию
В 3x быстрее при на 30% меньшем числе токенов

Мультимодальное понимание в реальном времени

Справляется с анализом видео, пониманием изображений и визуальными вопросами и ответами, подходит для мультимодальных сценариев реального времени, таких как помощь в играх и итерации дизайна.

Смотреть документацию
Мультимодальное понимание в реальном времени

Как развернуть Gemini 3 Flash API на Velokey

Начните всего за несколько шагов.

1

Зарегистрируйтесь и получите API Key

Войдите в консоль Velokey, чтобы сгенерировать API Key, который аутентифицирует каждый запрос, отправленный к Gemini 3 Flash.

2

Настройте параметры запроса

Установите модель gemini-3-flash и отправьте сообщения. Добавляйте изображения или видео для мультимодальных задач и делайте запросы компактными, чтобы использовать преимущества задержки уровня Flash.

3

Интегрируйте и начните вызывать

Отправляйте запросы на единый endpoint Velokey /v1/chat/completions для работы ассистентов, агентов и интерактивных приложений, с управлением использованием в одной консоли.

Практические сценарии использования Gemini 3 Flash

От инженерии до интерактивных продуктов — охватывает множество низколатентных сценариев.

Агентный кодинг и итеративная разработка

78% на SWE-bench Verified с задержкой уровня Flash — подходит для агентного кодинга, быстрых итераций и циклов разработки с использованием инструментов.

Интерактивные приложения, которым нужны быстрые ответы

Низкая задержка и низкая стоимость — подходят для интерактивных приложений, которым нужны быстрые высокочастотные ответы.

Мультимодальный анализ в реальном времени

Видео, изображения и визуальные вопросы и ответы — подходит для сценариев реального времени, таких как помощь в играх и итерации дизайна.

Сложные задачи на рассуждение

90.4% на GPQA Diamond и 33.7% на Humanity's Last Exam (без инструментов) — подходит для сложных научных и логических задач.

Высокочастотные рабочие процессы

Примерно в 3x быстрее, чем 2.5 Pro, с ~30% меньшим числом токенов — подходит для высокопроизводительных пайплайнов, чувствительных к стоимости.

Потребительские приложения

Скорость и стоимость уровня Flash — подходят для потребительских продуктов, обслуживающих множество пользователей в масштабе.

Почему стоит выбрать Velokey для Gemini 3 Flash

Скидка от прейскурантной цены

Вызывайте Gemini 3 Flash по более низкой цене на Velokey — оплата по мере использования без обязательной подписки снижает первоначальные затраты.

Единый API-интерфейс

Один API Key открывает доступ к Gemini 3 Flash и другим моделям — без необходимости управлять множеством аккаунтов и ключей, что упрощает интеграцию.

Полная документация и примеры

Справочники по endpoints, детали параметров и мультимодальные примеры помогают быстро интегрировать рассуждения, кодинг и зрение.

Стабильность и высокая доступность

Автоматическое переключение при сбое и стабильные резервные маршруты поддерживают доступность, когда основной маршрут недоступен, сохраняя надежность production.

Справочник API

Полные примеры вызовов API и описание параметров

Endpoint

https://api.velokey.ai/v1beta/models/{model}:generateContent

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1beta/models/{model}:generateContent \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3-flash-preview",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "gemini-3-flash-preview",
  "created": 1234567890,
  "data": { ... }
}

FAQ по Gemini 3 Flash API

Чем отличается Gemini 3 Flash?

Она сочетает рассуждения уровня Pro с задержкой, эффективностью и стоимостью уровня Flash, объединяя передовые рассуждения со скоростью серии Flash. Она достигает 90.4% на GPQA Diamond, 78% на SWE-bench Verified и 81.2% на MMMU Pro, работая примерно в 3x быстрее, чем Gemini 2.5 Pro.

Как ее кодинг сопоставим с Gemini 3 Pro?

На SWE-bench Verified она набирает 78%, превосходя как серию Gemini 2.5, так и Gemini 3 Pro — сильный вариант для агентного кодинга и итеративной разработки при значительно меньшей задержке.

Насколько она быстрая и эффективная?

Она работает примерно в 3x быстрее, чем Gemini 2.5 Pro, и использует в среднем примерно на 30% меньше токенов для типичных задач, что делает ее оптимизированной для низколатентных высокочастотных рабочих процессов.

Какие мультимодальные входные данные она поддерживает?

Она поддерживает анализ видео, понимание изображений и визуальные вопросы и ответы, что подходит для мультимодальных сценариев реального времени, таких как помощь в играх и итерации дизайна.

Как она тарифицируется на Velokey?

Тарификация идет по входным и выходным токенам со скидкой от прейскурантной цены. Текущая цена Velokey показана в блоке цен на этой странице и в панели вашей консоли, без обязательной подписки.

Начните работать с Gemini 3 Flash Preview уже сегодня

Один API-ключ — доступ к недорогим и стабильным ИИ-моделям через Velokey.