Kimi K3
Kimi K3 est le tout dernier modèle phare à poids ouverts de Moonshot AI — un MoE de 2 800 milliards de paramètres doté d'un contexte de 1 M de tokens et d'un raisonnement approfondi toujours actif, performant en codage agentique, en usage du terminal et des outils, ainsi qu'en compréhension multimodale. Accédez à l'API Kimi K3 sur Velokey à un prix inférieur — une seule clé API, paiement à l'usage, en dessous du tarif officiel.
Cas d'usage
Ingénierie logicielle de longue haleine · Agents et automatisation métier
Entrée
Texte, image
Sortie
Texte
Facturation
Par token
Démarrer une conversation
Saisissez un message ci-dessous pour commencer
Inscrivez-vous et recevez $0.5 de crédits gratuits — environ 20 images gratuites
Détails des tarifs
Tarification transparente à l'usage, sans frais cachés.
Tarifs détaillés
Détail des tarifs à l'usage
Kimi K3
| Spécification | Prix | Official/Fal Price(USD) | Économie |
|---|---|---|---|
| Input/1M tokens | 16 crédits≈$16 | 20 crédits | -20% |
| Output/1M tokens | 80 crédits≈$80 | 100 crédits | -20% |
| Cache Read/1M tokens | 1.6 crédits≈$1.6 | 2 crédits | -20% |
Règles de facturation
- Le prix de sortie varie selon le modèle, la résolution, la qualité, la durée ou l'usage de tokens.
- Les fichiers de référence téléversés peuvent être facturés séparément lorsqu'ils sont pris en charge.
- Les capacités additionnelles comme la recherche web ou d'images peuvent être facturées par requête.
- Les modèles à base de tokens sont facturés selon les tokens d'entrée et de sortie.
- Si la route principale est indisponible, Velokey peut basculer automatiquement vers une route de secours stable lorsque c'est possible.
- L'utilisation est à la demande, avec une déduction transparente des crédits.
* Le coût final dépend du résultat généré.
Modèles associés
Découvrez d'autres modèles de la même famille.
- MoonshotÉconomisez 20%
Kimi K2.5
Kimi K2.5 is Moonshot AI's visual agentic model with visual coding, four operating modes, and an Agent Swarm coordinating up to 100 sub-agents in parallel.
- MoonshotÉconomisez 20%
Kimi K2.6
Kimi K2.6 is Moonshot AI's model with state-of-the-art coding, Awwwards-level full-stack front-end generation, a 50+ agent swarm, and Document-to-Skills.
- MoonshotÉconomisez 20%
Kimi K2.7 Code
Kimi K2.7 Code is Moonshot AI's 1T-parameter (32B active) MoE coding model for long-horizon software engineering, with a 256K context and always-on thinking.
- OpenAIÉconomisez 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
API Kimi K3 abordable
Accédez au tout dernier modèle phare ouvert de Moonshot AI, Kimi K3, à un prix inférieur sur Velokey — MoE de 2,8 T, contexte de 1 M de tokens, codage agentique et multimodalité, compatible OpenAI, une seule clé API, paiement à l'usage, en dessous du tarif officiel.
Découvrez Kimi K3 et l'intégration de son API
Kimi K3 est le tout dernier modèle phare à poids ouverts de Moonshot AI — un MoE de 2 800 milliards de paramètres doté d'un contexte de 1 M de tokens et d'un raisonnement approfondi toujours actif, performant en codage agentique, en usage du terminal et des outils, ainsi qu'en compréhension multimodale. Sur Velokey, vous pouvez accéder à l'API Kimi K3 à un prix inférieur — une seule clé API, paiement à l'usage, en dessous du tarif officiel, sans abonnement imposé — avec les crédits, l'utilisation et le routage multi-modèles gérés depuis une seule console.
MoE de 2,8 T à poids ouverts avec raisonnement toujours actif
Kimi K3 utilise un MoE de 2 800 milliards de paramètres (896 experts, 16 activés par token) et exécute par défaut une chaîne de raisonnement toujours active à effort de raisonnement maximal, fournissant des réponses étayées sur le raisonnement complexe, les mathématiques et le travail intellectuel ; les poids sont publiés sous une licence Modified MIT, vous pouvez donc l'héberger vous-même ou l'appeler directement sur Velokey.
Voir la documentation →
Contexte long de 1 M de tokens
Une fenêtre de contexte de 1 M de tokens englobe de vastes bases de code, de longs documents et du matériel multimodal en une seule session, avec une tarification uniforme sur toute la fenêtre et sans surcoût pour le contexte long — parfaitement adaptée à la recherche, la synthèse et les tâches de longue haleine sur de longs contenus.
Voir la documentation →
Codage agentique et essaim d'agents
Kimi K3 traite l'usage du terminal et l'appel d'outils comme des capacités de premier plan, est compatible avec les schémas function/tool-call d'OpenAI, et prend en charge le mode planification, les listes de tâches, l'invocation de compétences, les agents imbriqués et les essaims de sous-agents parallèles — prenant en charge des sessions d'ingénierie de plusieurs heures et des tâches logicielles de longue haleine, et se classant parmi les meilleurs sur les benchmarks de code frontend et de codage SWE.
Voir la documentation →
Compréhension multimodale native
Prise en charge native du texte, des images et de la vidéo, ainsi que l'analyse directe des documents PDF, Word et Excel — adaptée à l'intégration de captures d'écran, de rapports et de contenus mixtes dans une seule passe de raisonnement, avec moins d'étapes distinctes d'analyse et de conversion.
Voir la documentation →
Comment déployer l'API Kimi K3 sur Velokey
Quelques étapes pour commencer à appeler.
Inscrivez-vous et obtenez une clé API
Créez une clé API dans la console Velokey ; une seule clé authentifie chaque requête envoyée à Kimi K3.
Définissez le modèle
Réglez model sur kimi-k3 et soumettez messages et tools (function calling) selon vos besoins.
Appelez et intégrez
Envoyez vos requêtes via le point d'accès unifié /v1/chat/completions de Velokey, compatible avec la convention d'appel d'OpenAI, avec l'utilisation et les crédits gérés depuis une seule console.
Cas d'usage concrets de Kimi K3
De l'ingénierie de longue haleine à la recherche et à l'analyse, adapté à de nombreux scénarios à forte autonomie.
Ingénierie logicielle de longue haleine
Avec l'usage du terminal, la navigation dans les bases de code et les essaims d'agents, prenez en charge des tâches d'ingénierie de plusieurs heures et en plusieurs étapes, de la spécification au code fonctionnel.
Agents et automatisation
Utilisez l'appel d'outils compatible OpenAI pour relier Kimi K3 aux chaînes d'outils et construire des agents multi-étapes qui planifient de façon autonome et s'exécutent en parallèle.
Recherche et analyse
Un raisonnement toujours actif associé à un contexte de 1 M de tokens convient à la recherche, la synthèse et l'analyse approfondie sur de longs documents, graphiques et code.
Traitement de documents multimodaux
Compréhension native des images et de la vidéo, avec analyse directe des PDF, Word et Excel, intégrant captures d'écran, rapports et contenus mixtes dans une seule passe.
Analyse de données et insights
Raisonnez en plusieurs étapes sur des données structurées et non structurées pour produire des conclusions, des synthèses et des recommandations de décision.
Travail intellectuel et contenu
Compréhension de longs documents, sortie structurée et génération de contenu, en assistant quotidien pour les équipes d'ingénierie et de recherche.
Pourquoi choisir Velokey pour Kimi K3
En dessous du tarif officiel
Appelez Kimi K3 à un prix inférieur sur Velokey — paiement à l'usage, sans abonnement imposé, avec un coût initial réduit.
Une clé, de nombreux modèles
Une seule clé API atteint Kimi K3 et les modèles d'autres fournisseurs, transformant le routage des tâches et le basculement inter-modèles en une simple configuration plutôt qu'en réécritures.
Accès unifié compatible OpenAI
Compatible avec la convention d'appel d'OpenAI ; changer de modèle se résume à modifier le champ model, ce qui maintient un coût d'intégration minimal.
Stabilité et haute disponibilité
Le basculement automatique et des routes de repli stables maintiennent la disponibilité lorsque la route principale est indisponible, préservant la stabilité en production.
Référence API
Exemples complets d'appels API et description des paramètres
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "kimi-k3",
"created": 1234567890,
"data": { ... }
}FAQ de l'API Kimi K3
Qu'est-ce que l'API Kimi K3 ?
Kimi K3 est le tout dernier modèle phare à poids ouverts de Moonshot AI — un MoE de 2 800 milliards de paramètres doté d'un contexte de 1 M de tokens et d'un raisonnement approfondi toujours actif, performant en codage agentique, en usage des outils et en compréhension multimodale. Sur Velokey, vous l'appelez via un accès unifié compatible OpenAI, avec model réglé sur kimi-k3.
Qu'est-ce qui distingue Kimi K3 ?
Il est présenté comme le plus grand modèle à poids ouverts (MoE de 2,8 T, 896 experts dont 16 activés), avec un raisonnement approfondi toujours actif, un usage du terminal et des outils de premier plan, des essaims de sous-agents parallèles et une compréhension native du texte, des images, de la vidéo et des documents PDF/Word/Excel — se classant parmi les meilleurs sur les benchmarks de code frontend et de codage SWE.
Quelle est la longueur du contexte de Kimi K3 ?
1 M de tokens (environ 1 048 576), suffisant pour englober de vastes bases de code, de longs documents et du matériel multimodal en une seule session, avec une tarification uniforme sur toute la fenêtre et sans surcoût pour le contexte long.
Kimi K3 prend-il en charge le function calling et les agents ?
Oui. Kimi K3 fait de l'appel d'outils et de l'usage du terminal des capacités de premier plan, compatible avec les schémas function/tool-call d'OpenAI, et prend en charge le mode planification, l'invocation de compétences et les essaims de sous-agents parallèles — adapté aux flux de travail agentiques de longue haleine qui planifient de façon autonome.
Comment est-il facturé sur Velokey ?
La section tarifs de cette page affiche les prix actuels de Velokey, facturés selon les tokens d'entrée et de sortie (environ $16 en entrée / $80 en sortie par 1 M de tokens, tarif officiel $20/$100). Les crédits sont gérés depuis un seul compte Velokey.
Commencez avec Kimi K3 dès aujourd'hui
Accédez à des modèles d'IA stables et économiques via Velokey avec une seule clé API.