Qwen3.6 Flash
Qwen3.6 Flashは、Alibaba CloudのオープンウェイトなスパースMoE(合計35B / アクティブ3B)で、262Kコンテキストを備え、エージェント型コーディングに優れています。Velokeyの統合エンドポイントから、定価未満の料金で利用できます。
ユースケース
エージェント型コーディングと複数ファイル開発 · ターミナルおよびツール駆動の自動化
入力
テキスト
出力
テキスト
課金方式
トークン課金
会話を始める
下にメッセージを入力して始めましょう
登録で $0.5 分の無料クレジット。画像を約 20 枚無料生成できます
料金詳細
従量課金の透明な価格設定で、隠れた費用はありません。
料金詳細
段階料金使用量ベースの料金内訳
| 仕様 | 価格 | 公式価格 | 節約 |
|---|---|---|---|
| Input/1M tokens | 0.2 クレジット≈$0.2 | 0.25 クレジット | -20% |
| Output/1M tokens | 1.2 クレジット≈$1.2 | 1.5 クレジット | -20% |
| Cache Read/1M tokens | 0.02 クレジット≈$0.02 | 0.025 クレジット | -20% |
| Cache Write/1M tokens | 0.25 クレジット≈$0.25 | 0.3125 クレジット | -20% |
| 仕様 | 価格 | 公式価格 | 節約 |
|---|---|---|---|
| Input/1M tokens | 0.8 クレジット≈$0.8 | 1 クレジット | -20% |
| Output/1M tokens | 3.2 クレジット≈$3.2 | 4 クレジット | -20% |
| Cache Read/1M tokens | 0.08 クレジット≈$0.08 | 0.1 クレジット | -20% |
| Cache Write/1M tokens | 1 クレジット≈$1 | 1.25 クレジット | -20% |
課金ルール
- 出力価格はモデル、解像度、品質、時間、トークン使用量によって変動します。
- アップロードした参照ファイルは、対応モデルでは別途課金される場合があります。
- ウェブ検索や画像検索などの追加機能はリクエストごとに課金される場合があります。
- トークンベースのモデルは入力・出力トークン数で課金されます。
- メインルートが利用できない場合、Velokey は可能な範囲で安定したフォールバックルートに自動的に切り替えることがあります。
- 従量課金制で、クレジットは透明に差し引かれます。
* 最終的な費用は生成結果によって異なります。
関連モデル
同じカテゴリの他のモデルを見る。
- Alibaba20% オフ
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
- Alibaba20% オフ
Qwen3.7 Plus
Qwen3.7-Plus is Alibaba's multimodal agent model with screen perception and GUI grounding, a 1M-token context, preserve_thinking, and low-cost pricing.
- Alibaba20% オフ
Qwen3.7 Max
Qwen3.7-Max is Alibaba's flagship agent model for long-horizon coding and MCP tool orchestration, sustaining hours-long autonomous runs over a 1M-token context.
- OpenAI20% オフ
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
手頃な価格のQwen3.6 Flash API
Alibaba CloudのQwen3.6 FlashをVelokeyで利用 — 効率的なスパースMoE、卓越したエージェント型コーディング、ネイティブ262Kコンテキスト、フロー全体での思考保持を、統合エンドポイントと本番アプリ向けの定価未満の料金で提供します。
Qwen3.6 FlashとそのAPIアクセスの紹介
Qwen3.6 Flash(Qwen3.6-35B-A3B)は、Alibaba Cloudが2026年4月14日にリリースしたオープンモデルで、スパースMixture-of-Expertsアーキテクチャを採用しています。合計35Bパラメータのうち、アクティブなのは3Bのみです。Gated DeltaNet線形アテンションと標準のGated Attention、スパースMoE(256エキスパート、8ルーティング + 1共有アクティブ)を組み合わせ、エージェント型コーディングでQwen3.5-35B-A3Bを大きく上回り、はるかに大規模な高密度モデルに匹敵します。重みはApache 2.0の下でHugging FaceとModelScopeに公開されており、ネイティブ262KコンテキストはYaRNを使って1Mトークンまで拡張可能です。 Velokeyは、手頃な価格で統合しやすいQwen3.6 Flash APIを提供します。統合チャットエンドポイント、明確なリクエストフロー、本番システム、エージェントパイプライン、自動化ツール向けの定価未満の料金を利用できます。
卓越したエージェント型コーディング
エージェント型コーディングでQwen3.5-35B-A3Bを大きく上回り、はるかに大規模な高密度モデルに匹敵します — SWE-bench Verified 73.4%およびTerminal-Bench 2.0 51.5% — 複数ファイルにまたがるエージェント型開発に適しています。
ドキュメントを見る →
効率的な35B/3BスパースMoE
合計35Bパラメータのうちアクティブなのは3Bのみで、Gated DeltaNet線形アテンションと256エキスパートのスパースMoE(8ルーティング + 1共有アクティブ)を組み合わせ、品質を維持しながら効率的で低コストな推論を実現します。
ドキュメントを見る →
ネイティブ262Kロングコンテキスト
ネイティブ262Kコンテキスト、YaRNにより1Mトークンまで拡張可能 — コードベース全体、非常に長いドキュメント、長期的なエージェント型ワークフローに適しています。
ドキュメントを見る →
エージェントフロー全体で思考を保持
thinking modeの保持により、拡張されたエージェント型ワークフロー全体で完全な推論コンテキストを維持するため、複数のツールステップ間で推論の連鎖が失われず、一貫性と安定性を保ちます。
ドキュメントを見る →
VelokeyでQwen3.6 Flash APIをデプロイする方法
ほんの数ステップで始められます。
サインアップしてAPI Keyを取得
Velokeyコンソールにサインインし、Qwen3.6 Flashに送信されるすべてのリクエストを認証するAPI Keyを生成します。
リクエストパラメータを設定
modelをqwen-3-6-flashに設定し、messagesを送信します。非常に長い入力ではYaRNを有効にしてコンテキストを1Mまで拡張し、長いエージェント型フロー全体で完全な推論を保持するためにthinking modeをオンにします。
統合して呼び出しを開始
Velokeyの統合/v1/chat/completionsエンドポイントにリクエストを送信して、アシスタント、エージェント、自動化を強化し、使用量を1つのコンソールで管理できます。
Qwen3.6 Flashの実世界でのユースケース
エージェント型コーディングから長文ドキュメント推論まで、多くの高自律性シナリオをカバーします。
エージェント型コーディングと複数ファイル開発
SWE-bench Verified 73.4%と線形アテンションの効率により、複数ファイルにまたがるエージェント型開発、リファクタリング、バグ修正に適しています。
ターミナルおよびツール駆動の自動化
Terminal-Bench 2.0で51.5% — ターミナル操作、ツール呼び出し、長期的な自動化タスクに適しています。
リポジトリ全体と長文ドキュメントの推論
ネイティブ262K(YaRNで1M)コンテキスト — コードベース全体や長いドキュメントにわたる検索、統合、QAに適しています。
効率的で低コストなデプロイ
35B/3BのスパースMoEはアクティブ化するパラメータが3Bのみです — コストとスループットが重要な大規模デプロイに適しています。
長期的なエージェントワークフロー
thinking modeの保持により完全な推論コンテキストを維持します — 多くのツールステップにまたがる長期的なエージェントオーケストレーションに適しています。
オープンウェイトのセルフホスティングとカスタマイズ
Apache 2.0のオープンウェイト(Hugging Face / ModelScope) — セルフホスティング、ファインチューニング、下流でのカスタマイズに適しています。
Qwen3.6 FlashにVelokeyを選ぶ理由
定価からの割引
VelokeyではQwen3.6 Flashをより低価格で呼び出せます — 強制的なサブスクリプションのない従量課金制で、初期コストを削減します。
統合APIインターフェース
1つのAPI KeyでQwen3.6 Flashや他のモデルにアクセスできます — 複数のアカウントやキーを扱う必要がなく、統合を簡素化します。
充実したドキュメントと移行ガイダンス
エンドポイントリファレンス、パラメータ詳細、移行例により、迅速な統合とロングコンテキストおよびthinking modeの採用を支援します。
安定性と高可用性
自動フェイルオーバーと安定したフォールバックルートにより、プライマリルートがダウンした場合でも可用性を維持し、本番環境の信頼性を保ちます。
API リファレンス
API 呼び出し例とパラメータの完全な説明
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-flash",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "qwen3.6-flash",
"created": 1234567890,
"data": { ... }
}Qwen3.6 Flash API FAQ
Qwen3.6 Flashとは何ですか?
これはAlibaba CloudのオープンモデルQwen3.6-35B-A3Bで、2026年4月14日にリリースされました(Model Studio APIではqwen3.6-flashとして提供)。合計35B、アクティブ3BパラメータのスパースMoEアーキテクチャを使用し、重みはApache 2.0の下でHugging FaceとModelScopeに公開されています。
そのアーキテクチャの特徴は何ですか?
Gated DeltaNet線形アテンションと標準のGated Attention、スパースMoE(256エキスパート、8ルーティング + 1共有アクティブ)を組み合わせた新しいアーキテクチャを採用し、アクティブパラメータわずか3Bで効率的な推論を実現しながら品質を維持します。
コンテキストウィンドウの大きさはどれくらいですか?
ネイティブコンテキストは262Kで、YaRNにより1Mトークンまで拡張可能です — コードベース全体、非常に長いドキュメント、長期的なエージェント型ワークフローに適しています。
エージェント型コーディングの性能はどの程度ですか?
エージェント型コーディングでQwen3.5-35B-A3Bを大きく上回り、はるかに大規模な高密度モデルに匹敵します。SWE-bench Verifiedで73.4%、Terminal-Bench 2.0で51.5%を記録し、長いフロー全体で完全な思考コンテキストを保持します。
Velokeyではどのように課金されますか?
このページの料金エリアには現在のVelokey価格が表示され、入力トークンと出力トークンに基づいて課金されます。定価からの割引があり、強制的なサブスクリプションはありません。