Qwen Code 本身是免費的:用戶端是 Apache-2.0 開源軟體,沒有付費方案,因此 Qwen Code 預算中的每一美元,都是另行購買的模型推理費用。大多數教學仍在描述的免費 Qwen OAuth 方案已於 2026 年 4 月 15 日終止,這表示 2026 年的預算必須從購買端點開始:Alibaba Cloud Model Studio Coding Plan、Token Plan Credit 套件、按使用量計費的 token 計費,或您自行設定用戶端來連線的第三方端點。
這四種路徑分別以四種不同單位計量——請求、Credits、權杖,以及您自己的提供者所收取的任何單位——因此只比較標題價格會得出錯誤答案。本頁將軟體成本與推理成本分開,提供可重新計算的權杖估算,並標示無法驗證的數字。
軟體費用與模型費用
QwenLM/qwen-code 儲存庫採用 Apache-2.0 授權且持續開發中;GitHub API 於 2026 年 9 月 21 日回報其未被封存。版本每週或更快發布:v0.24.0 於 2026 年 9 月 16 日以 @qwen-code/qwen-code 套件發布至 npm,v0.24.2則於 9 月 20 日推出,因此請查看 npm 套件登錄服務,不要相信頁面上顯示的任何版本。安裝方式包括 npm(Node.js 22 或更新版本)、Homebrew 或獨立安裝程式。
現在仍稱其為終端機 CLI 已不足以概括它。README 標題將其描述為適用於終端機、編輯器、桌面、瀏覽器和聊天的開源 AI 程式設計代理程式;該專案提供桌面應用程式、透過 qwen serve --open 啟動的 Web UI、VS Code、Zed 和 JetBrains 外掛程式、TypeScript、Python 和 Java SDK,以及聊天頻道。儲存庫的 GitHub 描述欄位仍稱它是駐留在終端機中的代理程式,因此兩者不一致;列出額外介面的部分以 README 為準。這些介面都不是付費升級——它們全部位於同一個免費儲存庫中,而且任何介面都不包含推理功能。
有一項繼承關係值得排除:Qwen Code 最初以 Google Gemini CLI v0.8.2 為基礎,但專案表示已在 v0.1 停止與上游同步,並獨立開發。Gemini CLI 的額度和定價不會轉移過來。
Qwen Code 免費額度:終止了什麼,以及何時終止
驗證文件指出,Qwen OAuth 免費方案已於 2026-04-15 終止,現有的快取權杖可能會暫時繼續運作,但新的請求會被拒絕。OAuth 不再是 /auth 對話框中可選的項目;目前僅以已終止的提供者身分保留在文件中。這是搜尋結果中關於此主題最過時的單一事實。
| 期間 | 免費 OAuth 額度 | 證據 |
|---|---|---|
| 截至 v0.9.0(npm,2026 年 2 月 3 日) | 每日 2,000 次請求,每分鐘 60 次請求 | 驗證文件包含在 v0.9.0 標籤中 |
| 自 v0.10.0 起(npm,2026 年 2 月 9 日) | 每日 1,000 次請求,每分鐘 60 次請求 | v0.10.0 至 v0.14.0 標籤中的相同檔案 |
| 自 2026 年 4 月 15 日起 | 無——已終止 | 目前的驗證文件;問題 #3316於 4 月 16 日提出並已關閉 |
關於這張表有兩項注意事項。我們找不到任何地方宣布每日額度從 2,000 降至 1,000 的確切日曆日期;上方括號是根據已發布文件在哪個版本標籤中變更推導出的,而不是來自 Qwen 的公告。此外,廣泛流傳的「在終止前額度降至每日 100 次」說法,在我們檢查的版本標籤中完全沒有出現:v0.9.0 至 v0.14.0 是唯一載明額度的版本,它們先後寫明 2,000 和 1,000;從 v0.15.0 起,該檔案載明沒有額度,因為該方案已經終止。請將每日 100 次視為沒有支持的數字。我們也沒有找到任何關於終止的官方部落格文章或新聞稿,因此這項資訊是被記錄下來,而不是被公告。
對於希望恢復免費路徑的人而言,還有兩項限制很重要。Qwen OAuth 模型是寫死的,無法透過 modelProviders 覆寫,因此已終止的路徑不能簡單地重新指向另一個端點。此外,OAuth 從未能以無頭模式使用:文件指出,在 CI、SSH 或容器環境中,您通常根本無法完成瀏覽器登入流程。
三個官方端點、三種計費單位
在 /auth 中,Alibaba ModelStudio 會開啟包含 Coding Plan、Token Plan 和 Standard API Key 的子選單。這不是支付同一筆帳單的三種方式:文件為每種方式提供各自的端點主機和金鑰,並要求您將 baseUrl 與金鑰所屬的方案相符。Coding Plan 金鑰以 sk-sp- 開頭;Token Plan 金鑰沒有前綴要求。
| 方式 | 計費單位 | 公布價格 | 端點主機 |
|---|---|---|---|
| Coding Plan Pro(國際版) | 請求 | $50/月 | coding-intl.dashscope.aliyuncs.com |
| Coding Plan Pro(中國網站) | 請求 | ¥200/月,新客戶首月 ¥39.90 | coding.dashscope.aliyuncs.com |
| Token Plan,Personal | 點數 | Lite $8(促銷價 $6)、Essential $16($10)、Standard $25($18)、Pro $80($68)每月 | token-plan.ap-southeast-1.maas.aliyuncs.com |
| Token Plan,Team | 點數 | Standard $30($20)、Pro $100($75)、Max $200,每個席位每月 | 相同的新加坡主機 |
| 標準 API 金鑰 | Token | 按模型計算,依輸入長度分級 | dashscope.aliyuncs.com |
Coding Plan 頁面將 Pro 定價為每月 $50,並設有三項同時存在的上限:每 5 小時最多 6,000 次請求、每週 45,000 次,以及每月 90,000 次。達到任一上限後,呼叫會暫停。每週額度於 UTC+08:00 星期一 00:00:00 重設,每月額度則在您的續訂日重設。Alibaba 表示這些額度不會累計,也不代表可隨時間平均分配的容量。2026 年 10 月 1 日,該頁面也將 Pro 標示為供應有限:名額先到先得,並於 UTC+08:00 每日 00:00:00 補充,因此您嘗試當天可能無法購買訂閱。
一次請求實際會花費多少:同一頁面指出,每次查詢會依模型呼叫次數消耗額度,簡單任務通常使用 5-10 次呼叫,複雜任務則使用 10-30 次或更多。因此,一項指令實際上會產生許多請求。若照字面解讀,每月 90,000 次請求約可涵蓋 3,000 至 18,000 項任務,但 Alibaba 將這些呼叫數描述為典型值而非保證值,並表示實際消耗量會因任務複雜度、內容和工具使用而異。在選定方案規模前,請先在自己的帳戶中測量。
有兩個過時數字應予捨棄。Coding Plan 的 Lite 方案已取消——中國頁面記載,新訂閱於 2026 年 3 月 20 日停止,續訂和升級則於 2026 年 4 月 13 日停止——因此,任何仍將較便宜的 Lite 方案列為可用選項的比較網站都已過時。此外,¥200 的中國價格並不是將 $50 國際價格換算而來:以近期任何匯率計算,¥200 都明顯低於 $50,因此請將兩個商店視為分開的商業方案,並在您自己的主控台中確認價格、貨幣和資格,不要假設其中一個會換算成另一個。
Token Plan 需要揭露兩項資訊。首先是矛盾之處:Token Plan 概覽銷售固定的每月 Credit 額度——截至 2026 年 10 月 1 日,每個 Personal 層級都採用 30 天的訂閱月份(本頁首次撰寫時使用 7 天視窗),Team 則採用月週期——達到額度後會暫停服務,以 $15 銷售 20,000 Credits 的 Extra Bundles,並表示未使用的額度不會結轉;但 Qwen Code 的驗證文件將 Token Plan 描述為團隊和公司的按使用量計費。這些描述彼此不一致;實際銷售它的是 Alibaba 頁面,而其內容讀起來像訂閱方案。其次,Alibaba 表示 Token Plan 目前僅在新加坡區域提供,但用戶端文件也列出北京 Token Plan 主機。請在結帳時確認區域可用性。
最後,銷售 Credits 的頁面並未提供 Credits 與詞元之間的換算資訊。Token Plan 概覽發布了每個層級的 Credit 數量——截至 2026 年 10 月 1 日,Personal Lite、Essential、Standard 和 Pro 每月分別為 11,500、25,500、45,000 和 180,000 Credits——但沒有 Credit 對詞元的換算率,也沒有各模型的換算乘數,因此該頁面沒有任何資訊能讓您說明每月 $18 可購買多少詞元。如果您的主控台其他位置提供換算率,請查閱該處資訊,不要相信第三方換算。
按使用量計費的費率,以及一個已過期的官方頁面
Model Studio 定價頁面列出每百萬權杖的美元費率,並依每次請求的輸入長度分級。下表是新加坡欄位;同一頁面也列出明顯較低的中國(北京)費率,因此在使用這些數字前,請確認您的帳戶按哪個區域計費。
| 模型 | 0-32K 輸入 | 32K-128K | 128K-256K | 256K-1M |
|---|---|---|---|---|
| qwen3-coder-plus | 輸入 $1/輸出 $5 | $1.8 / $9 | $3 / $15 | $6 / $60 |
| qwen3-coder-next | 輸入 $0.3/輸出 $1.5 | $0.5 / $2.5 | $0.8 / $4 | 未列出 |
在為長時間代理程式工作階段編列預算前,請先查看最高層級:當請求的輸入超過 256K 後,qwen3-coder-plus 的輸出價格會從每百萬權杖 $5 上升至 $60。長內容代理程式對話的定價不同於短對話。新加坡區域的新帳戶也會獲得每個模型 1 million tokens 的免費贈送額度,自啟用、模型發布或核准日起有效 90 天,以較晚者為準——這是試用贈送額度,而不是免費方案。
有一個陷阱值得特別指出,因為它位於官方網域且仍出現在搜尋排名中:qwen3-coder-plus 降價頁面宣布了上下文快取折扣,其促銷期間為 2025 年 7 月 24 日至 8 月 23 日。它既是官方頁面,同時也已過期。我們未在此列出其他 Qwen 模型的費率,因為 qwen3.7-plus 表格將思考和非思考輸出分成不同欄位,而我們對該表的解讀不夠可靠,無法發布。
Qwen Code 最佳 API:將用戶端指向其他位置
Qwen Code 支援四種通訊協定——OpenAI Chat Completions、OpenAI Responses、Anthropic 和 Gemini/Vertex——而且每種都可以指向自訂基礎 URL。其自己的文件將 OpenRouter 和 Fireworks AI 列為 OAuth 終止後可切換使用的替代方案,因此第三方端點是受支援的路徑,而不是權宜解法。Kunavo 在 https://api.kunavo.com/v1 下提供 /v1/chat/completions、/v1/responses 和 /v1/messages,這四種線路格式中的其中三種。
請清楚了解這樣購買到的是什麼。Kunavo 的目錄中沒有 Qwen 文字模型,因此這不是執行 Qwen 的較便宜方式,而是在 Qwen Code 中使用單一預付餘額執行 Claude 或 GPT 模型的方式。Kunavo 也尚未針對這些端點執行 Qwen Code 執行階段測試,不過現在已有一個Qwen Code 設定頁面,其內容是根據 Qwen Code 自己的文件撰寫,方式與 Cline 和 OpenCode 頁面相同。請將以下設定視為已記錄的起點,並在嘗試期間保留可運作的路由。
export OPENAI_API_KEY="your-kunavo-key"
export OPENAI_BASE_URL="https://api.kunavo.com/v1"
export OPENAI_MODEL="claude-sonnet-5"基礎 URL 保留其 /v1 後綴 — 文件中的每個 OPENAI_BASE_URL 範例都以此結尾,而 Qwen Code 會自行附加路由。QWEN_MODEL 是 OPENAI_MODEL 可接受的別名。等效的單一檔案設定位於 ~/.qwen/settings.json。
{
"modelProviders": {
"openai": [
{
"id": "claude-sonnet-5",
"name": "Claude Sonnet 5",
"baseUrl": "https://api.kunavo.com/v1",
"envKey": "OPENAI_API_KEY"
}
]
},
"env": {
"OPENAI_API_KEY": "your-kunavo-key"
},
"security": {
"auth": {
"selectedType": "openai"
}
},
"model": {
"name": "claude-sonnet-5"
}
}模型提供者參考文件與上方連結的驗證文件中,有四項設定事實能實際節省除錯時間。只有 OpenAI 相容的憑證具有 CLI 旗標 — 存在 --openai-api-key 和 --openai-base-url,沒有 Anthropic 或 Gemini 的對應項目。提供者專用的環境金鑰本身不會選取驗證類型,因此若只使用環境變數進行設定,請匯出 OPENAI_API_KEY,而不是以廠商命名的變數。憑證優先順序會將所選 modelProviders 項目的 baseUrl 和 envKey 置於 CLI 旗標之上 — 它們優先於 --openai-base-url 和 --openai-api-key,這正是多數人最容易猜反的排序 — 接著是 CLI 旗標、環境變數,最後是 settings.json。只有在執行中的工作階段透過 /auth 輸入的值優先於 modelProviders。環境變數包含找到的第一個 .env 檔案所提供的內容,而該檔案只會填入尚未設定的變數 — 不會合併多個檔案中的變數。此外,執行中的工作階段會即時重新載入 modelProviders 的編輯內容,而 providerProtocol 只會在啟動時讀取,因此需要重新啟動。
需要納入規劃的兩項限制。內建的 web_search 工具由 DashScope 自有的伺服器端搜尋提供支援,因此決定是否啟用它的是主機,而不是方案:ModelStudio Standard API Key 和 Token Plan 會啟用它;指向已識別 DashScope Responses 主機且使用直接金鑰的自訂或 modelProviders 項目也會啟用它。第三方提供者以及其他任何主機上的自訂端點都會停用它 — 付費 Coding Plan 也會停用,因為該端點尚未針對此 API 完成驗證。最後一列正好揭示了這點:這是主機閘門,而不是使用自有金鑰的懲罰。文件列出的替代方案是 MCP 搜尋伺服器,或讓 tools.webSearch.model 指向另一個受支援的 DashScope 金鑰,同時讓主要模型在其他地方執行。另一方面,wireApi: "responses" 需要真正相容於 Responses 的端點,且文件表示不存在端點偵測,也不會在呼叫失敗時自動回退。我們尚未測試 Kunavo 的 Responses 路由是否符合 Qwen Code 的需求,因此請從 Chat Completions 開始。
可重新計算的每月估算
假設某個月份包含 2,000 萬個未快取輸入 token 和 100 萬個輸出 token。按照目前的 Kunavo 目錄價格,計算結果如下:
| 模型 | 每 1M 的輸入/輸出 | 估計每月費用 | 候選角色 |
|---|---|---|---|
| Claude Haiku 4.5 | $0.70 / $3.50 | $17.50 | 有界、高用量的編輯與例行編碼工作 |
| GPT-5.6 Terra | $0.70 / $4.20 | $18.20 | 混合推理與工具使用 |
| Claude Sonnet 5 | $1.40 / $7.00 | $35.00 | 困難的儲存庫變更 |
這是基於假設工作負載的 token 計算,不是實測的 Qwen Code 任務,也不是帳單上限。它不包含快取費用、外部工具與稅金,並假設較便宜的模型能在不需要額外嘗試的情況下完成工作 — 而這正是較低費率是否會產生較低帳單的真正決定條件。Kunavo 的目錄金額是計費下限而非上限:上游回報費用時,帳單金額取目錄成本與上游成本乘以適用加成兩者中的較高者。請參閱 計費詳細資訊。
請注意這張表無法做什麼。它不能與 $50 Coding Plan 比較,因為該方案按模型呼叫次數計量,而此估算按 token 計量;呼叫次數不包含 token 數量。它也不能與 Token Plan 比較,因為 Credits 沒有公開的 token 換算方式。將訂閱方案與按量計費進行比較,需要使用你自己在兩者上的實測用量。
Kunavo 以 $10 預付儲值起始,無需訂閱。這是開啟有資金帳戶所需的現金,不是執行任務的成本。
Qwen Code 最便宜的 API:哪條路由勝出,取決於
| 選擇 | 適用情境 | 你放棄的功能 |
|---|---|---|
| Coding Plan 訂閱 | 穩定的每日 Qwen 使用量,且維持在請求上限內 | 達到任何上限時呼叫都會暫停;沒有內建網路搜尋;配額與任何其他使用該金鑰的工具共用 |
| 標準隨用隨付 token | 突發或偶爾使用,以及希望精確定價的長上下文工作階段 | 輸入長度分級會讓大型請求的費率大幅提高 |
| Token Plan Credits | 你已在自己的主控台確認模型的 Credit 費率 | 沒有公開換算方式;每月配額用完時服務會暫停;提供新加坡地區使用 |
| 例如 Kunavo 的閘道 | 你希望在 Qwen Code 中使用 Claude 或 GPT 模型,並共用一個預付餘額 | 沒有 Qwen 模型;需要自訂提供者設定;沒有內建網路搜尋 |
| 本機推論 | 你擁有合適的硬體,且模型能處理你的工具工作流程 | 硬體、維護與工具呼叫可靠性由你負責 |
把這兩個問題分開。每百萬 token 的最低列示價格,是你可以從頁面上讀出的事實;完成任務的最低成本,則是沒有人為此用戶端公布過的測量結果,包括我們在內。先在兩條路由上執行相同的三項任務 — 小型編輯、錯誤修正與多檔案調查 — 比較記錄的費用後,再做決定。
如果你想嘗試閘道路由,請先建立 Kunavo 帳戶,然後依照快速入門與 Chat Completions 參考文件取得端點和模型 ID。若要對其他用戶端做相同決策,請參閱 OpenCode 價格、Cline 價格以及OpenAI 相容 API 指南。
常見問題
Qwen Code 的費用是多少?
Qwen Code 用戶端本身不收費。它是 GitHub 上 QwenLM/qwen-code 專案中的 Apache-2.0 開源軟體,沒有付費方案、席位或訂閱,桌面應用程式、Web UI、編輯器外掛程式和 SDK 也都包含在同一個免費儲存庫中。您需要支付的是模型推理費用,並須向您設定的端點另行購買。
Qwen Code 仍然免費嗎?Qwen Code 的免費額度是多少?
軟體仍然免費,但託管推理已不再免費:Qwen Code 自己的驗證文件指出,Qwen OAuth 免費方案已於 2026-04-15 終止,OAuth 也不再是 /auth 對話框中可選的項目。引用每日 2,000 次請求的教學,描述的是截至 2026 年 2 月 v0.9.0(含該版本)提供的額度。Alibaba 平台目前剩餘的免費額度,是新帳戶在新加坡區域每個模型獲贈的 100 萬 token,有效期 90 天;這是試用贈送額度,而不是免費方案。
Qwen Code 最佳的 API 是哪一個?
這取決於您想要哪個模型。若特別針對 Qwen 模型,Alibaba Cloud Model Studio 是第一方來源:如果您的使用量穩定且請求形狀固定,可選擇 Coding Plan 訂閱;如果使用量有尖峰,則可選擇按使用量計費的權杖計費。Qwen Code 自己的文件也在 OAuth 終止後將 OpenRouter 和 Fireworks AI 列為替代方案。如果您想在 Qwen Code 中執行 Claude、GPT 或 Gemini 模型,任何 OpenAI 相容、Anthropic 或 Gemini 端點都可以設定為自訂提供者。
Qwen Code 最便宜的 API 是哪一個?
每百萬權杖的最低標示價格,與完成一項任務的最低成本,是兩個不同的問題,而價格頁面只能回答前者。在 Alibaba 發布的新加坡費率中,qwen3-coder-next 的每百萬權杖輸入 $0.30、輸出 $1.50(0-32K 輸入層級),比 qwen3-coder-plus 的 $1 和 $5 便宜。較便宜的模型對您的儲存庫是否真的更省錢,取決於它需要多少次嘗試,而已發布的價格表無法衡量這一點。
Coding Plan 訂閱只能搭配 Qwen Code 使用嗎?
不。Alibaba Cloud 的 Coding Plan 頁面將 Claude Code、Cline、Cursor、Codex、OpenCode、OpenClaw、Qoder、Lingma、Cherry Studio、Chatbox 及其他工具列為支援的工具,其模型清單也包含 glm-5、kimi-k2.5 和 MiniMax-M2.5 等非 Qwen 模型。一個訂閱不會綁定單一用戶端,這也表示其他工具消耗的額度,會成為 Qwen Code 無法再使用的額度。
我可以使用 Kunavo 額度支付 Qwen Code 中的 Qwen 模型費用嗎?
不可以。Kunavo 的目錄中沒有 Qwen 文字模型,因此 Kunavo 無法成為更便宜的 Qwen 推理路徑。Kunavo 能做的是透過 OpenAI 相容、Responses 和 Anthropic Messages 端點提供 Claude 和 GPT 模型,而 Qwen Code 的文件指出支援這些線路格式。Kunavo 尚未針對這些端點執行 Qwen Code 執行階段測試,因此請將此設定視為可嘗試的已記錄路徑,而非已驗證的整合。
Qwen Code 儲存庫、版本發布資料與文件已於 2026 年 9 月 21 日核對,來源包括 github.com/QwenLM/qwen-code、npm registry,以及 main 分支和 v0.9.0 至 v0.15.0 發布標籤中隨附的文件。Alibaba Cloud Coding Plan、Token Plan 與模型價格頁面也於同日核對,並於 2026 年 10 月 1 日重新核對;當日此處更新了 Token Plan 配額條款與 Coding Plan 可用性說明。Kunavo token 費率取自即時目錄;每月總額是示意性的 token 計算,不是實測任務成本。