Velokey

ERNIE 5.0

百度Chatin 75 · out 75 Crédits / 1M tokens≈$75 / $75Disponible

ERNIE 5.0 est le modèle phare multimodal natif de Baidu Wenxin, couvrant le texte, l’image, la vidéo et l’audio, avec de solides capacités de raisonnement et d’agent. Accédez-y via le point de terminaison unifié de Velokey avec une tarification inférieure au prix catalogue.

Multimodal natif2.4T paramètres, ~3% actifsTexte / image / vidéo / audioContexte 128K

Cas d'usage

Codage et automatisation par agents · Compréhension et création multimodales

Entrée

Texte, image

Sortie

Texte

Facturation

Par token

0.7
02
2048
2568192
ernie-5.0

Démarrer une conversation

Saisissez un message ci-dessous pour commencer

Inscrivez-vous et recevez $0.5 de crédits gratuits — environ 20 images gratuites

Détails des tarifs

Tarification transparente à l'usage, sans frais cachés.

Tarifs détaillés

Tarification par paliers

Détail des tarifs à l'usage

<= 32K tokensLongueur de contexte ≤ 32K
SpécificationPrix
Input/1M tokens0.9 crédits≈$0.9
Output/1M tokens3.5 crédits≈$3.5
> 32K tokensLongueur de contexte > 32K
SpécificationPrix
Input/1M tokens1.5 crédits≈$1.5
Output/1M tokens5.8 crédits≈$5.8

Règles de facturation

  • Le prix de sortie varie selon le modèle, la résolution, la qualité, la durée ou l'usage de tokens.
  • Les fichiers de référence téléversés peuvent être facturés séparément lorsqu'ils sont pris en charge.
  • Les capacités additionnelles comme la recherche web ou d'images peuvent être facturées par requête.
  • Les modèles à base de tokens sont facturés selon les tokens d'entrée et de sortie.
  • Si la route principale est indisponible, Velokey peut basculer automatiquement vers une route de secours stable lorsque c'est possible.
  • L'utilisation est à la demande, avec une déduction transparente des crédits.

* Le coût final dépend du résultat généré.

API ERNIE 5.0 abordable

Accédez à ERNIE 5.0 de Baidu Wenxin sur Velokey — un modèle phare multimodal natif à l’échelle du billion, avec texte, image, vidéo et audio unifiés, activation clairsemée efficace, et solides capacités de raisonnement et d’agents, via un point de terminaison unifié avec une tarification inférieure au prix catalogue.

Découvrez ERNIE 5.0 et son accès API

ERNIE 5.0 est le modèle phare de Baidu Wenxin, publié le February 6, 2026. Il repose sur une architecture multimodale native : un réseau autorégressif unifié de 2.4 billions de paramètres qui traite le texte, l’image, la vidéo et l’audio dans un seul cadre, plutôt que de fusionner des modèles séparés. Un MoE Modality-Agnostic Routing n’active qu’environ 3% des paramètres par jeton, et une stratégie Elastic Training permet une profondeur, une largeur et une parcimonie variables pour une flexibilité de déploiement. Velokey fournit une API ERNIE 5.0 abordable et facile à intégrer : un point de terminaison de chat unifié, un flux de requêtes clair et une tarification inférieure au prix catalogue pour les systèmes de production, les pipelines d’agents et les applications multimodales. Sur cette plateforme, vous pouvez envoyer des entrées texte, image et vidéo, et recevoir une sortie texte.

Architecture multimodale unifiée native

Un seul réseau autorégressif unifié traite ensemble le texte, l’image, la vidéo et l’audio — Next-Token Prediction pour le texte, Next-Frame-and-Scale Prediction pour les images et Next-Codec Prediction pour l’audio — au lieu d’assembler des modèles séparés après coup.

Voir la documentation
Architecture multimodale unifiée native

Efficacité MoE à l’échelle du billion

2.4 billions de paramètres avec un MoE Modality-Agnostic Routing qui n’active qu’environ 3% des paramètres par jeton, plus une stratégie Elastic Training pour une profondeur, une largeur et une parcimonie variables — une capacité à l’échelle du billion qui reste efficace à déployer.

Voir la documentation
Efficacité MoE à l’échelle du billion

Génération multimodale haute fidélité

Génère des images haute fidélité, des vidéos de pointe dans l’industrie et un audio de premier plan à partir d’un seul modèle — meilleur de sa catégorie pour la compréhension audio TUT2017 avec une synthèse vocale compétitive, unifiant compréhension et création.

Voir la documentation
Génération multimodale haute fidélité

Connaissances, raisonnement, codage et agents

Solides capacités de récupération de connaissances, de raisonnement logique, de génération de code, de suivi d’instructions et d’appel d’outils par des agents, avec une fenêtre de contexte progressivement étendue de 8K à 128K jetons pour le travail à long horizon.

Voir la documentation
Connaissances, raisonnement, codage et agents

Comment déployer l’API ERNIE 5.0 sur Velokey

Commencez en quelques étapes seulement.

1

Inscrivez-vous et obtenez une clé API

Connectez-vous à la console Velokey pour générer une clé API qui authentifie chaque requête envoyée à ERNIE 5.0.

2

Configurez les paramètres de requête

Définissez le modèle sur ernie-5-0 et soumettez des messages. Transmettez des entrées texte, image et vidéo, et recevez une sortie texte, avec un contexte allant jusqu’à 128K jetons.

3

Intégrez et commencez les appels

Envoyez des requêtes au point de terminaison unifié /v1/chat/completions de Velokey pour alimenter des assistants, des agents et des applications multimodales, avec l’utilisation gérée dans une seule console.

Cas d’utilisation concrets pour ERNIE 5.0

De l’ingénierie au travail créatif et analytique, en couvrant de nombreux scénarios à forte valeur.

Assistants de codage et de développement

La génération de code et le suivi d’instructions le rendent adapté aux assistants de développement, à la refactorisation et aux outils d’aide à la revue de code.

Agents et appel d’outils

L’appel d’outils fiable par des agents le rend adapté à l’automatisation en plusieurs étapes, à l’orchestration et aux flux de travail d’agents à long horizon.

Compréhension et création multimodales

Comprend le texte, l’image et la vidéo, et génère des images haute fidélité ainsi que des vidéos de pointe dans l’industrie — adapté aux contenus et aux studios créatifs.

Récupération de connaissances et Q&R

De solides capacités de récupération de connaissances conviennent aux assistants de recherche, aux questions-réponses d’entreprise et aux assistants augmentés par récupération sur de longs documents.

Analyse et raisonnement

Le raisonnement logique sur un contexte de 128K convient à l’analyse de données, à l’extraction structurée et à la synthèse multi-documents.

Applications audio et vocales

La compréhension audio TUT2017, meilleure de sa catégorie, avec une synthèse vocale compétitive convient aux flux de transcription, de voix et d’analyse audio.

Pourquoi choisir Velokey pour ERNIE 5.0

Remise sur le prix catalogue

Appelez ERNIE 5.0 à un prix inférieur sur Velokey — paiement à l’utilisation sans abonnement imposé, réduisant le coût initial.

Interface API unifiée

Une seule clé API permet d’accéder à ERNIE 5.0 et à d’autres modèles — plus besoin de jongler avec plusieurs comptes et clés, ce qui simplifie l’intégration.

Documentation complète et conseils

Les références de points de terminaison, les détails des paramètres et les exemples multimodaux vous aident à intégrer facilement les entrées texte, image et vidéo.

Stable et hautement disponible

Le basculement automatique et les routes de secours stables maintiennent la disponibilité lorsque la route principale est indisponible, garantissant la fiabilité en production.

Référence API

Exemples complets d'appels API et description des paramètres

Endpoint

https://api.velokey.ai/v1/chat/completions

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1/chat/completions \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ernie-5.0",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "ernie-5.0",
  "created": 1234567890,
  "data": { ... }
}

FAQ de l’API ERNIE 5.0

Qu’est-ce qui fait d’ERNIE 5.0 un modèle multimodal natif ?

Il utilise un seul cadre autorégressif unifié entre les modalités au lieu de fusionner ensuite des modèles séparés : Next-Token Prediction pour le texte, Next-Frame-and-Scale Prediction pour les images et Next-Codec Prediction pour l’audio, le tout dans un réseau unique.

Quelle est la taille du modèle et comment reste-t-il efficace ?

Il possède 2.4 billions de paramètres, mais un MoE Modality-Agnostic Routing n’en active qu’environ 3% par jeton. Une stratégie Elastic Training prend en charge une profondeur, une largeur et une parcimonie variables pour une flexibilité de déploiement, afin que la capacité à l’échelle du billion reste efficace à servir.

Quelles entrées et sorties sont prises en charge sur Velokey ?

Sur cette plateforme, vous pouvez envoyer des entrées texte, image et vidéo, et recevoir une sortie texte. Le modèle lui-même prend également en charge la génération d’images haute fidélité, de vidéos de pointe dans l’industrie et d’audio, et il est le meilleur de sa catégorie pour la compréhension audio TUT2017 avec une synthèse vocale compétitive.

Quelle est la taille de la fenêtre de contexte ?

La fenêtre de contexte a été progressivement étendue de 8K à 128K jetons, afin que vous puissiez raisonner sur de longs documents, des conversations étendues et des flux de travail d’agents en plusieurs étapes.

Comment la facturation fonctionne-t-elle sur Velokey ?

La zone de tarification de cette page et votre tableau de bord affichent le prix Velokey actuel, facturé selon les jetons d’entrée et de sortie avec une remise sur le prix catalogue. Une clé API et un point de terminaison unifié simplifient l’intégration.

Commencez avec ERNIE 5.0 dès aujourd'hui

Accédez à des modèles d'IA stables et économiques via Velokey avec une seule clé API.