ERNIE 5.0
ERNIE 5.0 est le modèle phare multimodal natif de Baidu Wenxin, couvrant le texte, l’image, la vidéo et l’audio, avec de solides capacités de raisonnement et d’agent. Accédez-y via le point de terminaison unifié de Velokey avec une tarification inférieure au prix catalogue.
Cas d'usage
Codage et automatisation par agents · Compréhension et création multimodales
Entrée
Texte, image
Sortie
Texte
Facturation
Par token
Démarrer une conversation
Saisissez un message ci-dessous pour commencer
Inscrivez-vous et recevez $0.5 de crédits gratuits — environ 20 images gratuites
Détails des tarifs
Tarification transparente à l'usage, sans frais cachés.
Tarifs détaillés
Tarification par paliersDétail des tarifs à l'usage
| Spécification | Prix |
|---|---|
| Input/1M tokens | 0.9 crédits≈$0.9 |
| Output/1M tokens | 3.5 crédits≈$3.5 |
| Spécification | Prix |
|---|---|
| Input/1M tokens | 1.5 crédits≈$1.5 |
| Output/1M tokens | 5.8 crédits≈$5.8 |
Règles de facturation
- Le prix de sortie varie selon le modèle, la résolution, la qualité, la durée ou l'usage de tokens.
- Les fichiers de référence téléversés peuvent être facturés séparément lorsqu'ils sont pris en charge.
- Les capacités additionnelles comme la recherche web ou d'images peuvent être facturées par requête.
- Les modèles à base de tokens sont facturés selon les tokens d'entrée et de sortie.
- Si la route principale est indisponible, Velokey peut basculer automatiquement vers une route de secours stable lorsque c'est possible.
- L'utilisation est à la demande, avec une déduction transparente des crédits.
* Le coût final dépend du résultat généré.
Modèles associés
Découvrez d'autres modèles de la même famille.
- BaiduÉconomisez 20%
ERNIE 5.1
ERNIE 5.1 is an efficient sub-network of ERNIE 5.0 with much lower inference cost, strong agentic, reasoning, world-knowledge, and creative-writing abilities.
- OpenAIÉconomisez 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
- AlibabaÉconomisez 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
- AnthropicÉconomisez 20%
Claude Fable 5
Anthropic's Mythos-class frontier model, state-of-the-art across coding, agentic work, vision, and scientific research.
API ERNIE 5.0 abordable
Accédez à ERNIE 5.0 de Baidu Wenxin sur Velokey — un modèle phare multimodal natif à l’échelle du billion, avec texte, image, vidéo et audio unifiés, activation clairsemée efficace, et solides capacités de raisonnement et d’agents, via un point de terminaison unifié avec une tarification inférieure au prix catalogue.
Découvrez ERNIE 5.0 et son accès API
ERNIE 5.0 est le modèle phare de Baidu Wenxin, publié le February 6, 2026. Il repose sur une architecture multimodale native : un réseau autorégressif unifié de 2.4 billions de paramètres qui traite le texte, l’image, la vidéo et l’audio dans un seul cadre, plutôt que de fusionner des modèles séparés. Un MoE Modality-Agnostic Routing n’active qu’environ 3% des paramètres par jeton, et une stratégie Elastic Training permet une profondeur, une largeur et une parcimonie variables pour une flexibilité de déploiement. Velokey fournit une API ERNIE 5.0 abordable et facile à intégrer : un point de terminaison de chat unifié, un flux de requêtes clair et une tarification inférieure au prix catalogue pour les systèmes de production, les pipelines d’agents et les applications multimodales. Sur cette plateforme, vous pouvez envoyer des entrées texte, image et vidéo, et recevoir une sortie texte.
Architecture multimodale unifiée native
Un seul réseau autorégressif unifié traite ensemble le texte, l’image, la vidéo et l’audio — Next-Token Prediction pour le texte, Next-Frame-and-Scale Prediction pour les images et Next-Codec Prediction pour l’audio — au lieu d’assembler des modèles séparés après coup.
Voir la documentation →
Efficacité MoE à l’échelle du billion
2.4 billions de paramètres avec un MoE Modality-Agnostic Routing qui n’active qu’environ 3% des paramètres par jeton, plus une stratégie Elastic Training pour une profondeur, une largeur et une parcimonie variables — une capacité à l’échelle du billion qui reste efficace à déployer.
Voir la documentation →
Génération multimodale haute fidélité
Génère des images haute fidélité, des vidéos de pointe dans l’industrie et un audio de premier plan à partir d’un seul modèle — meilleur de sa catégorie pour la compréhension audio TUT2017 avec une synthèse vocale compétitive, unifiant compréhension et création.
Voir la documentation →
Connaissances, raisonnement, codage et agents
Solides capacités de récupération de connaissances, de raisonnement logique, de génération de code, de suivi d’instructions et d’appel d’outils par des agents, avec une fenêtre de contexte progressivement étendue de 8K à 128K jetons pour le travail à long horizon.
Voir la documentation →
Comment déployer l’API ERNIE 5.0 sur Velokey
Commencez en quelques étapes seulement.
Inscrivez-vous et obtenez une clé API
Connectez-vous à la console Velokey pour générer une clé API qui authentifie chaque requête envoyée à ERNIE 5.0.
Configurez les paramètres de requête
Définissez le modèle sur ernie-5-0 et soumettez des messages. Transmettez des entrées texte, image et vidéo, et recevez une sortie texte, avec un contexte allant jusqu’à 128K jetons.
Intégrez et commencez les appels
Envoyez des requêtes au point de terminaison unifié /v1/chat/completions de Velokey pour alimenter des assistants, des agents et des applications multimodales, avec l’utilisation gérée dans une seule console.
Cas d’utilisation concrets pour ERNIE 5.0
De l’ingénierie au travail créatif et analytique, en couvrant de nombreux scénarios à forte valeur.
Assistants de codage et de développement
La génération de code et le suivi d’instructions le rendent adapté aux assistants de développement, à la refactorisation et aux outils d’aide à la revue de code.
Agents et appel d’outils
L’appel d’outils fiable par des agents le rend adapté à l’automatisation en plusieurs étapes, à l’orchestration et aux flux de travail d’agents à long horizon.
Compréhension et création multimodales
Comprend le texte, l’image et la vidéo, et génère des images haute fidélité ainsi que des vidéos de pointe dans l’industrie — adapté aux contenus et aux studios créatifs.
Récupération de connaissances et Q&R
De solides capacités de récupération de connaissances conviennent aux assistants de recherche, aux questions-réponses d’entreprise et aux assistants augmentés par récupération sur de longs documents.
Analyse et raisonnement
Le raisonnement logique sur un contexte de 128K convient à l’analyse de données, à l’extraction structurée et à la synthèse multi-documents.
Applications audio et vocales
La compréhension audio TUT2017, meilleure de sa catégorie, avec une synthèse vocale compétitive convient aux flux de transcription, de voix et d’analyse audio.
Pourquoi choisir Velokey pour ERNIE 5.0
Remise sur le prix catalogue
Appelez ERNIE 5.0 à un prix inférieur sur Velokey — paiement à l’utilisation sans abonnement imposé, réduisant le coût initial.
Interface API unifiée
Une seule clé API permet d’accéder à ERNIE 5.0 et à d’autres modèles — plus besoin de jongler avec plusieurs comptes et clés, ce qui simplifie l’intégration.
Documentation complète et conseils
Les références de points de terminaison, les détails des paramètres et les exemples multimodaux vous aident à intégrer facilement les entrées texte, image et vidéo.
Stable et hautement disponible
Le basculement automatique et les routes de secours stables maintiennent la disponibilité lorsque la route principale est indisponible, garantissant la fiabilité en production.
Référence API
Exemples complets d'appels API et description des paramètres
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "ernie-5.0",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "ernie-5.0",
"created": 1234567890,
"data": { ... }
}FAQ de l’API ERNIE 5.0
Qu’est-ce qui fait d’ERNIE 5.0 un modèle multimodal natif ?
Il utilise un seul cadre autorégressif unifié entre les modalités au lieu de fusionner ensuite des modèles séparés : Next-Token Prediction pour le texte, Next-Frame-and-Scale Prediction pour les images et Next-Codec Prediction pour l’audio, le tout dans un réseau unique.
Quelle est la taille du modèle et comment reste-t-il efficace ?
Il possède 2.4 billions de paramètres, mais un MoE Modality-Agnostic Routing n’en active qu’environ 3% par jeton. Une stratégie Elastic Training prend en charge une profondeur, une largeur et une parcimonie variables pour une flexibilité de déploiement, afin que la capacité à l’échelle du billion reste efficace à servir.
Quelles entrées et sorties sont prises en charge sur Velokey ?
Sur cette plateforme, vous pouvez envoyer des entrées texte, image et vidéo, et recevoir une sortie texte. Le modèle lui-même prend également en charge la génération d’images haute fidélité, de vidéos de pointe dans l’industrie et d’audio, et il est le meilleur de sa catégorie pour la compréhension audio TUT2017 avec une synthèse vocale compétitive.
Quelle est la taille de la fenêtre de contexte ?
La fenêtre de contexte a été progressivement étendue de 8K à 128K jetons, afin que vous puissiez raisonner sur de longs documents, des conversations étendues et des flux de travail d’agents en plusieurs étapes.
Comment la facturation fonctionne-t-elle sur Velokey ?
La zone de tarification de cette page et votre tableau de bord affichent le prix Velokey actuel, facturé selon les jetons d’entrée et de sortie avec une remise sur le prix catalogue. Une clé API et un point de terminaison unifié simplifient l’intégration.
Commencez avec ERNIE 5.0 dès aujourd'hui
Accédez à des modèles d'IA stables et économiques via Velokey avec une seule clé API.