Qwen3.7 Max
Qwen3.7-Max est le modèle agent phare d’Alibaba pour le codage à long horizon, l’orchestration MCP et l’autonomie sur plusieurs heures, avec un contexte de 1M de tokens. Accédez-y via le point de terminaison unifié de Velokey avec une tarification inférieure au prix catalogue.
Cas d'usage
Agent de codage de bout en bout · Ingénierie sur base de code complète
Entrée
Texte
Sortie
Texte
Facturation
Par token
Démarrer une conversation
Saisissez un message ci-dessous pour commencer
Inscrivez-vous et recevez $0.5 de crédits gratuits — environ 20 images gratuites
Détails des tarifs
Tarification transparente à l'usage, sans frais cachés.
Tarifs détaillés
Détail des tarifs à l'usage
| Spécification | Prix | Officiel | Économie |
|---|---|---|---|
| Input/1M tokens | 2 crédits≈$2 | 2.5 crédits | -20% |
| Output/1M tokens | 6 crédits≈$6 | 7.5 crédits | -20% |
| Cache Read/1M tokens | 0.2 crédits≈$0.2 | 0.25 crédits | -20% |
| Cache Write/1M tokens | 2.5 crédits≈$2.5 | 3.13 crédits | -20% |
Règles de facturation
- Le prix de sortie varie selon le modèle, la résolution, la qualité, la durée ou l'usage de tokens.
- Les fichiers de référence téléversés peuvent être facturés séparément lorsqu'ils sont pris en charge.
- Les capacités additionnelles comme la recherche web ou d'images peuvent être facturées par requête.
- Les modèles à base de tokens sont facturés selon les tokens d'entrée et de sortie.
- Si la route principale est indisponible, Velokey peut basculer automatiquement vers une route de secours stable lorsque c'est possible.
- L'utilisation est à la demande, avec une déduction transparente des crédits.
* Le coût final dépend du résultat généré.
Modèles associés
Découvrez d'autres modèles de la même famille.
- AlibabaÉconomisez 20%
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
- AlibabaÉconomisez 20%
Qwen3.6 Flash
Qwen3.6 Flash (35B-A3B) is Alibaba's open-weight MoE coding model with strong agentic coding, thinking-mode preservation, and a native 262K context (up to 1M with YaRN).
- AlibabaÉconomisez 20%
Qwen3.7 Plus
Qwen3.7-Plus is Alibaba's multimodal agent model with screen perception and GUI grounding, a 1M-token context, preserve_thinking, and low-cost pricing.
- OpenAIÉconomisez 20%
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
API Qwen3.7-Max abordable
Accédez au Qwen3.7-Max d’Alibaba sur Velokey — un agent de codage phare, un contexte de 1M de tokens, une autonomie à long horizon sur plusieurs heures et l’orchestration d’outils MCP, avec un point de terminaison unifié et une tarification inférieure au prix catalogue pour les applications d’agents en production.
Découvrez Qwen3.7-Max et son accès API
Qwen3.7-Max est le modèle propriétaire phare d’Alibaba, lancé le 20 mai 2026 lors de l’Alibaba Cloud Summit et conçu pour l’ère des agents : flux de travail de codage à long horizon, orchestration d’outils MCP et exécution autonome de tâches sur plusieurs heures (et non quelques secondes). Sa fenêtre de contexte passe de 262K sur Qwen3.6-Max-Preview à 1 million de tokens (environ 2,000 pages), suffisamment vaste pour charger la plupart des bases de code d’entreprise sans échafaudage de récupération ; en tant qu’agent de codage, il excelle du prototypage frontend à l’ingénierie complexe multi-fichiers. C’est un modèle texte uniquement, avec un équivalent multimodal, Qwen3.7-Plus. Velokey fournit une API Qwen3.7-Max abordable et facile à intégrer : un point de terminaison de chat unifié, un flux de requêtes clair et une tarification inférieure au prix catalogue pour les systèmes de production, les pipelines d’agents et les outils d’automatisation.
Codage agentique phare (du frontend au multi-fichiers)
Excelle du prototypage frontend à l’ingénierie complexe multi-fichiers en tant qu’agent de codage phare qui livre des applications complètes de bout en bout. Benchmarks de codage : SWE-Pro 60.6, SWE-Multilingual 78.3, SciCode 53.5, QwenSVG 1608.
Voir la documentation →
Contexte de 1M de tokens
La fenêtre de contexte passe de 262K sur Qwen3.6-Max-Preview à 1 million de tokens (environ 2,000 pages), suffisamment vaste pour charger la plupart des bases de code d’entreprise sans échafaudage de récupération et raisonner sur l’ensemble du dépôt.
Voir la documentation →
Exécution à long horizon de 35 heures
Maintient un raisonnement cohérent sur des horizons extrêmement longs — démontré par une exécution d’optimisation de noyau entièrement autonome de 35 heures comprenant plus de 1,000 appels d’outils, faisant passer les tâches de quelques secondes à plusieurs heures.
Voir la documentation →
Orchestration d’outils MCP
Naturellement performant dans l’orchestration d’outils MCP, coordonnant de nombreux modules d’outils connectés sur de longues exécutions autonomes afin de maintenir des flux de travail complexes comme un système cohérent unique.
Voir la documentation →
Comment déployer l’API Qwen3.7-Max sur Velokey
Démarrez en seulement quelques étapes.
Inscrivez-vous et obtenez une clé API
Connectez-vous à la console Velokey pour générer une clé API qui authentifie chaque requête envoyée à Qwen3.7-Max.
Configurez les paramètres de requête
Définissez le modèle sur qwen-3-7-max et soumettez des messages. Utilisez toute la fenêtre de 1M de tokens pour un contexte très long et associez des outils MCP pour alimenter l’exécution autonome à long horizon.
Intégrez et commencez les appels
Envoyez des requêtes au point de terminaison unifié /v1/chat/completions de Velokey pour alimenter des agents de codage et l’automatisation, avec l’utilisation gérée dans une seule console.
Cas d’utilisation concrets de Qwen3.7-Max
De l’ingénierie aux agents d’entreprise, couvrant de nombreux scénarios à forte autonomie.
Agent de codage de bout en bout
Du prototypage frontend à l’ingénierie complexe multi-fichiers, il livre des applications complètes de bout en bout en tant qu’agent de codage phare.
Ingénierie sur base de code complète
Avec un contexte de 1M de tokens, chargez toute une base de code d’entreprise pour le développement et le refactoring sans échafaudage de récupération.
Tâches autonomes à long horizon
Maintient un raisonnement cohérent sur des horizons de plusieurs heures, adapté aux tâches autonomes avec plus de 1,000 appels d’outils.
Orchestration d’outils MCP
Coordonne de nombreux modules d’outils connectés, en orchestrant des flux de travail complexes multi-outils comme un système cohérent unique.
Optimisation scientifique et au niveau du noyau
Adapté au codage scientifique de type SciCode et à l’optimisation au niveau du noyau qui exigent un raisonnement à long horizon et des itérations répétées.
DevOps autonome et automatisation
Exécution autonome sur plusieurs heures avec orchestration d’outils, adaptée aux DevOps à long horizon, au traitement par lots et aux pipelines d’automatisation.
Pourquoi choisir Velokey pour Qwen3.7-Max
Remise sur le prix catalogue
Appelez Qwen3.7-Max à un prix inférieur sur Velokey — paiement à l’utilisation sans abonnement imposé, réduisant le coût initial.
Interface API unifiée
Une seule clé API donne accès à Qwen3.7-Max et à d’autres modèles — plus besoin de gérer plusieurs comptes et clés, ce qui simplifie l’intégration.
Documentation complète et conseils de migration
Les références de points de terminaison, les détails des paramètres et les exemples de migration vous aident à passer en douceur depuis Qwen3.6-Max-Preview et à adopter le contexte de 1M de tokens ainsi que les outils MCP.
Stable et hautement disponible
Le basculement automatique et les routes de repli stables maintiennent la disponibilité lorsque la route principale est indisponible, garantissant la fiabilité des tâches d’agents à long horizon.
Référence API
Exemples complets d'appels API et description des paramètres
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.7-max",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "qwen3.7-max",
"created": 1234567890,
"data": { ... }
}FAQ de l’API Qwen3.7-Max
Qu’est-ce que Qwen3.7-Max ?
Il s’agit du modèle propriétaire phare d’Alibaba, lancé le 20 mai 2026 lors de l’Alibaba Cloud Summit et conçu pour l’ère des agents — flux de travail de codage à long horizon, orchestration d’outils MCP et exécution autonome de tâches sur plusieurs heures. C’est un modèle texte uniquement (un équivalent multimodal, Qwen3.7-Plus, existe).
Comment fonctionne le contexte de 1M de tokens ?
La fenêtre de contexte passe de 262K sur Qwen3.6-Max-Preview à 1 million de tokens (environ 2,000 pages), suffisamment vaste pour charger la plupart des bases de code d’entreprise sans échafaudage de récupération et raisonner directement sur l’ensemble du dépôt.
Quelle est la qualité de l’exécution à long horizon ?
Il maintient un raisonnement cohérent sur des horizons extrêmement longs — démontré par une exécution d’optimisation de noyau entièrement autonome de 35 heures comprenant plus de 1,000 appels d’outils.
Quels sont ses résultats sur les benchmarks de codage ?
Les benchmarks d’agent de codage sont SWE-Pro 60.6, SWE-Multilingual 78.3, SciCode 53.5 et QwenSVG 1608, couvrant du prototypage frontend à l’ingénierie complexe multi-fichiers.
Comment est-il facturé sur Velokey ?
La zone de tarification de cette page affiche le prix Velokey actuel, facturé selon les tokens d’entrée et de sortie avec une remise sur le prix catalogue. Une seule clé API vous donne un accès unifié.
Commencez avec Qwen3.7 Max dès aujourd'hui
Accédez à des modèles d'IA stables et économiques via Velokey avec une seule clé API.