# QwenCloud 上線 Qwen3.8-Max-0902，支援約 1M-token context；input 每百萬 2 美元、output 每百萬 6 美元

> 📖 本站完整內容索引（documentation index）：[llms.txt](/llms.txt)

> 原作者：Qwen (@Alibaba_Qwen) · 策展與摘要：EasyVibeCoding · 平台：X (Twitter) · 熱度：🔥🔥🔥🔥 · 日期：2026-09-02

> 原始來源：https://x.com/Alibaba_Qwen/status/2094968708288680276

## 證據與延伸閱讀

- [QwenCloud 上線 Qwen3.8-Max-0902，支援約 1M-token context；input 每百萬 2 美元、output 每百萬 6 美元。](https://qwencloud.com/models/qwen3.8-max-0902) — 官方文件 · 最後核對：2026-09-02 · 支持主張：正式 dossier 補上跨 coding、agent 與 multimodal 的 benchmark matrix，以及各 benchmark 的 harness/方法 footnotes：不同模型可能使用不同 harness、best published scores、in-house benchmarks，空白欄位代表 not available/not applicable 而非失敗。也補上 image/text/video input、API limits、pricing、cache 與安全文件的邊界，讓 vendor claim、Arena 外部評測與 platform-wide safety 分開呈現。
- [Qwen3.8-Max-0902 — docs.qwencloud.com](https://docs.qwencloud.com/developer-guides/run-and-scale/safety) — 官方文件 · 最後核對：2026-09-02 · 支持主張：正式 dossier 補上跨 coding、agent 與 multimodal 的 benchmark matrix，以及各 benchmark 的 harness/方法 footnotes：不同模型可能使用不同 harness、best published scores、in-house benchmarks，空白欄位代表 not available/not applicable 而非失敗。也補上 image/text/video input、API limits、pricing、cache 與安全文件的邊界，讓 vendor claim、Arena 外部評測與 platform-wide safety 分開呈現。
- [Qwen3.8-Max-0902 Code Arena WebDev — @arena](https://x.com/arena/status/2094974637704913198) — 一手來源 · 最後核對：2026-09-02 · 支持主張：補上獨立評測的 live WebDev evidence：639,235 votes、20 labs，Qwen 1691 plus or minus 19、rank spread 1 to 4；Claude Opus 5 為 1687 plus or minus 8。Qwen 的信賴區間與 Opus 5 重疊且 entry 標為 preliminary，因此四分 point-estimate 差距不能寫成 statistically settled lead；這個結果只涵蓋 front-end web-development agentic tasks，不代表一般模型優越性。
- [Qwen3.8-Max-0902 Code Arena WebDev — arena.ai](https://arena.ai/leaderboard/code/webdev?rankBy=labs) — 一手來源 · 最後核對：2026-09-02 · 支持主張：補上獨立評測的 live WebDev evidence：639,235 votes、20 labs，Qwen 1691 plus or minus 19、rank spread 1 to 4；Claude Opus 5 為 1687 plus or minus 8。Qwen 的信賴區間與 Opus 5 重疊且 entry 標為 preliminary，因此四分 point-estimate 差距不能寫成 statistically settled lead；這個結果只涵蓋 front-end web-development agentic tasks，不代表一般模型優越性。
- [Qwen3.8-Max-0902 定價](https://x.com/Alibaba_Qwen/status/2094968708288680276) — 一手來源

## 中文摘要

QwenCloud 上線 Qwen3.8-Max-0902，支援約 1M-token context；input 每百萬 2 美元、output 每百萬 6 美元。

**模型與能力**  
Alibaba Qwen 於 2026 年 9 月 2 日發布 Qwen3.8-Max-0902 snapshot，並以 Coding 與 Cowork post-training 強化企業複雜任務、科學研究及長時間工作流。QwenCloud 的別名為 `qwen3.8-max-2026-09-02`，可接受圖片、文字與影片，並輸出文字。API 功能包括前綴補全（接續既有程式碼）、函式呼叫、結構化輸出、批次處理、網頁搜尋、微調與平台內建工具；主要面向工程規模程式開發、長時間自主開發、多工具協作、端到端交付、圖表推理、文件解析與多模態理解。 

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/fe2fc22413c547db.jpg)
> Qwen3.8-Max 的發布宣傳海報，背景為黑色科技感網格與三個發光且帶有二進位碼紋路的幾何圖塊，上方標有白色的 Qwen3.8-Max 與藍色 -0902 版本號，中央下方則帶有藍色的 NOW More Capable 字樣。

**Benchmark 與成本**  
官方模型頁新增涵蓋程式開發、代理任務與多模態能力的 benchmark 表格，列出 TerminalBench 3.0 29.0、DeepSWE 1.1 69.3、QwenSWEBench V2 70.0、CoWorkBench 76.1、Automation Bench v1.0.6 Pass@1 50.8、Toolathlon Verified Pass@1 73.3、MMMU-Pro 82.7、BabyVision with code interpreter 93.8 等結果。不過各欄位可能採用不同評測框架（harness）、最佳已發布分數或內部 benchmark；空白欄位代表 not available 或 not applicable，不是失敗，因此不能直接視為同條件比較。定價為每百萬 input tokens $2、output tokens $6；implicit-cache hits 為 $0.25，explicit-cache read 為 $0.17，建立 explicit cache 為 $2.50。 

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/b700dbb3eb02233c.jpg)
> 在圖中列出的模型裡，Qwen3.8-Max-0902 於 MLS-Bench-Lite（50.1）、SWE-Atlas QnA（66.3）、QwenSWEBench V2（70.0）、Automation Bench v1.0.6（50.8）、ERQA（78.3）與 BabyVision（93.8）取得該欄最高分；各 benchmark 的評測條件不一定相同。

**API 限制與安全邊界**  
QwenCloud 列出的限制包含 991K max input、131K max output、1M total context、262K max reasoning，顯示 rate limits 為每分鐘 1M tokens 與 15K requests。安全文件指出 API 輸入輸出會經自動審查，並要求開發者自行做應用層驗證、輸出檢查、prompt injection 防護，以及高風險決策的人工覆核。一般輸入輸出以記憶體處理、不保留作模型訓練；但 Responses API 在 `store=true` 時預設保存對話 30 天，可改用 `store=false` 停用，這些是 platform-wide 邊界，不是 0902 snapshot 的模型專屬安全評測。

**獨立評測**  
Arena 的 Code Arena WebDev live leaderboard 在本次查核時累積 639,235 votes、涵蓋 20 labs，將 qwen3.8-max-0902 列為 preliminary rank 1，分數 1691 ± 19，rank spread 為 1–4；Claude Opus 5 為 1687 ± 8。@arena 發文附圖是較早的靜態截圖，顯示 Qwen 1691、Claude 1688、Kimi K3 1674；兩個時間點的 Claude 點估計因此相差 1 分。以即時榜單計算，Qwen 與 Claude 點估計相差 4 分，但兩者信賴區間重疊，且結果仍標示 preliminary，不能寫成統計上已確定領先。該評測只涵蓋需要多步推理與工具使用的代理式前端網頁開發任務，不代表 Qwen3.8-Max-0902 在一般工作負載全面優越。 

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/ecc5a0aca4422071.jpg)
> 來源：[@arena](https://x.com/arena/status/2094974637704913198)｜@arena 發文採用的靜態截圖顯示 Qwen3.8-Max-0902 為 1,691 分、Claude Opus 5 (Max) 為 1,688 分、Kimi K3 (Max) 為 1,674 分；這張圖沒有呈現後續即時榜單的票數、信賴區間或 preliminary rank spread。

## 標籤

新產品, Qwen3.8-Max-0902, Alibaba, QwenCloud
