Qwen Code 自体は無料です。クライアントは Apache-2.0 のオープンソースで有料プランがないため、Qwen Code の予算から出るすべての金額は別途購入するモデル推論に充てられます。 大半のチュートリアルが現在も説明している無料の Qwen OAuth オファーは、2026 年 4 月 15 日に終了しました。2026 年時点では、予算は有料エンドポイントから始まります。Alibaba Cloud Model Studio の Coding Plan、Credits Token Plan のパッケージ、トークン単位の従量課金、または自分で設定する第三者エンドポイントです。
これら 4 つの方式は、リクエスト、Credits、トークン、利用するプロバイダー独自の請求という 4 つの異なる単位で測定されます。そのため、表示価格だけで比較すると誤った結論になります。このページではソフトウェアのコストと推論コストを分け、再計算可能な見積もりを示し、検証できなかった点を明記します。詳細な英語版は Qwen Code pricing です。
ソフトウェアは無料、モデルは無料ではありません
QwenLM/qwen-code リポジトリは Apache-2.0 で、活発に開発されています。GitHub API では 2026 年 10 月 1 日時点でアーカイブされておらず、同日にも push がありました。リリースは少なくとも毎週行われており、v0.24.7 は 2026 年 9 月 29 日に npm (@qwen-code/qwen-code) で公開されました。スタンドアロンスクリプト、npm(Node.js 22 以上)、または Homebrew でインストールできます。同じ無料リポジトリからデスクトップアプリ、Web インターフェース(qwen serve --open)、VS Code・Zed・JetBrains 拡張機能、TypeScript・Python・Java SDK が提供されます。これらのいずれも有料オプションではなく、推論も含みません。
除外すべき関係があります。Qwen Code は当初 Google Gemini CLI v0.8.2 を基にしていましたが、v0.1 以降は同期されていません。Gemini CLI のクォータや料金は適用されません。
無料枠:何がいつ終了したのか
認証ドキュメントによると、無料の Qwen OAuth オファーは 2026-04-15 に終了しました。キャッシュ済みのトークンは短時間機能する可能性がありますが、新しいリクエストは拒否されます。インターフェースで Qwen OAuth を選択すると、現在は「Discontinued — switch to Coding Plan or API Key」と表示されます。
| 期間 | 無料 OAuth クォータ | 出典 |
|---|---|---|
| v0.9.0 まで(npm、2026 年 2 月 3 日) | 1 日 2,000 リクエスト、1 分あたり 60 リクエスト | v0.9.0 タグ時点の認証ドキュメント |
| v0.10.0 以降(npm、2026 年 2 月 9 日) | 1 日 1,000 リクエスト、1 分あたり 60 リクエスト | v0.10.0~v0.14.0 タグでも同じファイル |
| 2026 年 4 月 15 日以降 | なし — 終了 | 現在のドキュメント;issue #3316 |
2,000 リクエストから 1,000 リクエストへ移行した正確な日付は、どこでも告知されていません。上記の範囲は、ドキュメントが変更されたバージョンタグに基づいています。広まっている 1 日 100 リクエストという数字は、検証したどのタグにも登場しないため、根拠のない情報と考えてください。Qwen OAuth モデルはハードコードされており、modelProviders経由でリダイレクトすることもできません。
公式エンドポイント 3 種類、請求単位 3 種類
/authでは、Alibaba ModelStudio に Coding Plan、Token Plan、Standard API Key のサブメニューがあります。これは同じ請求を支払う 3 つの方法ではありません。ドキュメントではそれぞれにホストとキーが指定され、baseUrl をキーのプランに合わせるよう求めています。Coding Plan のキーは sk-sp- で始まります。
| 経路 | 請求単位 | 公開料金(2026 年 10 月 1 日) | ホスト |
|---|---|---|---|
| Coding Plan Pro(国際) | リクエスト | $50/月 | coding-intl.dashscope.aliyuncs.com |
| Coding Plan Pro(中国サイト) | リクエスト | ¥200/月;新規顧客は初月 ¥39,90 | coding.dashscope.aliyuncs.com |
| Token Plan、Personal | クレジット | Lite $8(プロモーション $6)、Essential $16($10)、Standard $25($18)、Pro $80($68)/月 | token-plan.ap-southeast-1.maas.aliyuncs.com |
| Token Plan、Team | クレジット | Standard $30($20)、Pro $100($75)、Max $200/座席/月 | 同じシンガポールホスト |
| Standard API Key | トークン | モデルごと、入力長の区分ごと | dashscope.aliyuncs.com |
Coding Plan ページでは、Pro に 3 つの同時上限が適用されます。5 時間あたり最大 6,000 リクエスト、週あたり 45,000 リクエスト、月あたり 90,000 リクエストです。いずれかに達すると呼び出しは停止されます。5 時間クォータは時間の経過とともに回復し、週間クォータは月曜日 0 時(UTC+8)、月間クォータは更新日にリセットされます。2026 年 10 月 1 日、ページには提供数が限られていることも示されていました。枠は先着順で限られており、毎日補充されます(国際サイトは 0 時 UTC+8、中国サイトは 9 時 30 分 UTC+8)。Lite プランは存在しなくなりました。新規申し込みは 2026 年 3 月 20 日、更新とアップグレードは 2026 年 4 月 13 日に停止されました。また、¥200 は $50 の換算額ではありません。両方のサイトを別個のオファーとして扱ってください。
1 リクエストの実際のコスト:各質問はモデル呼び出し回数に応じてクォータを消費します。Alibaba によると、単純なタスクでは 5~10 回、複雑なタスクでは 10~30 回以上の呼び出しが必要です。したがって、1 つの指示が複数のリクエストに相当します。この計算では、月 90,000 リクエストは概算で 3,000~18,000 タスクに相当します。ただし Alibaba はこれらを典型値として示しており、保証値ではありません。規模を決める前に、自分のアカウントで測定してください。
Token Plan には 2 点注意が必要です。まず、内容が変更されています。2026 年 10 月 1 日時点で、Token Plan ページは Personal プランに、Lite、Essential、Standard、Pro それぞれ 11,500、25,500、45,000、180,000 Credits の月間クォータ(申し込みから 30 日のサイクル)を割り当てていました。クォータ到達後はサービスを停止し、追加パッケージを 20,000 Credits あたり $15 で販売し、未使用クォータは繰り越されないと記載していました。次に、そこには Credits からトークンへの換算も、モデルごとの倍率も公開されていません。したがって、月額 $18 で何トークン購入できるかを示す根拠はありません。このオファーはシンガポールリージョンでのみ販売されています。
トークン単位の従量課金
Model Studio の料金ページでは、各リクエストの入力長区分ごとに、100 万トークンあたりのドル価格が示されています。以下はシンガポールの列です。中国(北京)の料金は異なり、大幅に安いため、請求リージョンを確認してください。
| モデル | 入力 0~32K | 32K~128K | 128K~256K | 256K~1M |
|---|---|---|---|---|
| qwen3-coder-plus | 入力 $1 / 出力 $5 | $1,8 / $9 | $3 / $15 | $6 / $60 |
| qwen3-coder-next | 入力 $0,3 / 出力 $1,5 | $0,5 / $2,5 | $0,8 / $4 | 掲載なし |
長いエージェントセッションの予算を組む前に、最後の区分を確認してください。qwen3-coder-plus の出力料金は、1 リクエストの入力が 256K を超えると、100 万あたり $5 から $60 に上がります。シンガポールの新規アカウントには、モデルごとに 100 万トークンが無料で付与され、90 日間有効です。これは試用であり、無料プランではありません。また、qwen3-coder-plus の値下げに関する公式ページにも注意してください。そこで案内されているキャッシュ割引の期間は 2025 年 7 月 24 日から 8 月 23 日まででした。
Qwen Code を別のエンドポイントに接続する
Qwen Code は OpenAI Chat Completions、OpenAI Responses、Anthropic、Gemini/Vertex の 4 プロトコルに対応し、それぞれでカスタムベース URL を受け付けます。独自のドキュメントでは、OAuth 終了後の代替手段として OpenRouter と Fireworks AI を挙げています。Kunavo は /v1/chat/completions、/v1/responses、/v1/messages を https://api.kunavo.com/v1 で提供します。
これで何が得られるのかを明確にしましょう。 Kunavo のカタログには Qwen のテキストモデルがないため、Qwen を安く動かす方法ではありません。1 つのプリペイド残高で、Qwen Code 内で Claude または GPT を動かす方法です。Kunavo はこれらのエンドポイントに対して Qwen Code を実行していません。以下の設定は、英語の Qwen Code の設定ページなど、Qwen Code のドキュメントに基づくものです。
{
"modelProviders": {
"openai": [
{
"id": "claude-sonnet-5",
"name": "Claude Sonnet 5",
"baseUrl": "https://api.kunavo.com/v1",
"envKey": "KUNAVO_API_KEY"
}
]
},
"security": {
"auth": {
"selectedType": "openai"
}
},
"model": {
"name": "claude-sonnet-5"
}
}モデルプロバイダーのリファレンスから、デバッグに何時間も費やすことを避けるための 4 つの事実を示します。baseUrl は末尾を /v1 にします(SDK がパスを追加するため、/v1/chat/completions にすると 404 になります)。キーは envKey が指定する名前の変数から読み込まれ、settings.json に平文で記述するよりも .qwen/.env 経由が推奨されます。選択された modelProviders の設定項目が CLI オプション --openai-base-url と --openai-api-key より優先されるため、これらが無視されたように見えます。また、wireApi: "responses" にはエンドポイントの検出も自動フォールバックもありません。まず Chat Completions で開始してください。
2 つの制限を想定してください。組み込みの web_search ツールは DashScope のサーバー側検索に依存します。Standard API Key または Token Plan では有効ですが、Coding Plan では無効です(このエンドポイントでは未検証)。第三者プロバイダーや別ホスト上のエンドポイントでも無効です。文書化された代替手段は検索 MCP サーバーです。また、Kunavo 経由ではチャットのみ提供されます。埋め込み、音声合成、音声認識には対応しません。
再計算可能な月間見積もり
キャッシュされていない入力トークン 2,000 万個と出力トークン 100 万個の 1 か月を想定します。現在の Kunavo カタログ料金では:
| モデル | 100万当たりの入力/出力 | 見積月額 | 想定される役割 |
|---|---|---|---|
| Claude Haiku 4.5 | $0,70 / $3,50 | $17,50 | 範囲を限定した変更と大量処理 |
| GPT-5.6 Terra | $0,70 / $4,20 | $18,20 | 推論とツールの組み合わせ |
| Claude Sonnet 5 | $1,40 / $7,00 | $35,00 | リポジトリ内の難しい変更 |
これは想定負荷に対する算術であり、測定済みの Qwen Code タスクでも請求上限でもありません。キャッシュ、外部ツール、税金は除外し、安いモデルが追加試行なしで作業を完了すると仮定しています。Kunavo カタログの金額は請求額の下限であり、上限ではありません。上流側がコストを申告した場合、請求額はカタログコストと、適用される上乗せを掛けた上流コストのうち高い方になります。この表は、呼び出し数を数える $50 の Coding Plan とも、換算方法が公開されていない Credits の Token Plan とも比較できません。プランとカウンターを比較するには、両方で自分の実測使用量が必要です。
Kunavoは、サブスクリプションなしで$10の前払いチャージから利用できます。これは残高を入れたアカウントを開設するための金額であり、タスクの料金ではありません。Stripeのチェックアウトでは、カード(Visa、Mastercard、American Express)、Apple Pay、Google Pay、Linkを利用できます。SEPAダイレクトデビットは現在ご利用いただけません。
どの経路をいつ選ぶか
| 選択 | 適する場合 | 手放すもの |
|---|---|---|
| Coding Plan | Qwen を毎日定期的に使用し、リクエスト上限内に収まる場合 | 各上限で呼び出しが停止;組み込み Web 検索なし;キーを使用する他のツールとクォータを共有;枠が限定的 |
| トークン単位の従量課金 | 不定期または単発の使用、正確に見積もりたい長時間セッション | 大きなリクエストでは入力長区分によって料金が上昇 |
| Credits Token Plan | コンソールでモデルの Credits 料率を確認済みの場合 | 公開された換算なし、使い切るとサービスを停止する月間クォータ、シンガポールのみ |
| Kunavo のようなゲートウェイ | 1 つのプリペイド残高で Qwen Code 内の Claude または GPT を利用したい場合 | Qwen モデルなし;手動設定;組み込み Web 検索なし |
| ローカル推論 | 適切なハードウェアがあり、モデルがツールを処理できる場合 | ハードウェア、保守、ツール呼び出しの信頼性を自分で担う必要がある |
2 つの問題を分けて考えてください。100 万トークンあたりの価格はページで確認できますが、タスク完了までの最安コストは、このクライアントについて誰も公開しておらず、私たちも公開していません。小さな変更、バグ修正、複数ファイルの調査という同じ 3 つのタスクを 2 つの方式で実行し、記録された金額を比較してください。ゲートウェイ方式を試すには、Kunavo アカウントを作成し、クイックスタートに従ってください。
よくある質問
Qwen Code の料金はいくらですか?
Qwen Code クライアントは無料です。GitHub(QwenLM/qwen-code)で Apache-2.0 のオープンソースとして公開されており、有料プラン、座席課金、サブスクリプションはありません。デスクトップアプリ、Web インターフェース、エディター拡張機能、SDK も同じ無料リポジトリに含まれています。料金が発生するのはモデルの推論であり、設定するエンドポイントから別途購入します。
Qwen Code はまだ無料ですか?無料枠の上限は?
ソフトウェアは無料のままですが、ホスト型の無料推論は終了しています。Qwen Code の認証ドキュメントによると、無料の Qwen OAuth オファーは 2026 年 4 月 15 日に終了し、/auth メニューで OAuth を選択できなくなりました。1 日 2,000 リクエストと案内するチュートリアルは、2026 年 2 月の v0.9.0 まで提供されていた割り当てを説明しています。Alibaba 側では、新規アカウント向けにシンガポールリージョンでモデルごとに 100 万トークン、90 日間有効の試用クレジットが残っています。これは試用であり、無料プランではありません。
Alibaba の Qwen Code 向け Coding Plan の料金はいくらですか?
国際サイトでは Coding Plan Pro は月額 $50 で、同時に 3 つの上限があります。5 時間あたり 6,000 リクエスト、週あたり 45,000 リクエスト、月あたり 90,000 リクエストです。いずれかの上限に達すると呼び出しは停止されます。1 リクエストは 1 回のモデル呼び出しに相当し、Alibaba によると、単純なタスクでは通常 5~10 回、複雑なタスクでは 10~30 回、またはそれ以上消費します。中国サイトでは同じ Pro が月額 ¥200(新規顧客は初月 ¥39.90)です。2026 年 10 月 1 日時点では提供数が限られており、枠は毎日補充されていました。旧 Lite プランは販売終了しています。
Qwen Code 向けに最も安い API はどれですか?
100 万トークンあたりの最安値と、タスクを完了するための最安コストは別の問題であり、料金表から分かるのは前者だけです。Alibaba がシンガポール向けに公開している料金では、100 万トークンあたり qwen3-coder-next は入力 $0.30、出力 $1.50(入力長 0~32K の区分)で、qwen3-coder-plus の入力 $1、出力 $5 より安価です。安いモデルが実際にあなたのリポジトリで安く済むかは、必要な試行回数次第であり、料金表では測定できません。
Kunavo のクレジットで Qwen モデルの料金を支払えますか?
いいえ。Kunavo のカタログには Qwen のテキストモデルがないため、Kunavo は Qwen を安く利用する手段ではありません。Kunavo でできるのは、OpenAI 互換エンドポイント(Chat Completions と Responses)および Anthropic Messages を介して Claude と GPT のモデルを提供することです。これらは Qwen Code が利用できる形式です。Kunavo はこれらのエンドポイントに対して Qwen Code を実行していません。これは試すことのできる文書化された設定であり、検証済みの統合ではありません。
2026 年 10 月 1 日に検証:Qwen Code のリポジトリ、バージョン、ドキュメント(メインブランチ、および無料クォータの履歴について v0.9.0~v0.15.0 タグ)、npm レジストリ、Coding Plan ページ(国際サイトと中国サイト)、Token Plan、Model Studio の料金。Kunavo の料金はライブカタログによるものです。月間合計はトークン数に基づく例示的な算術であり、測定済みのタスクコストではありません。