中國阿里巴巴旗下的通義千問團隊在 9 月 2 日推出 Qwen3.8-Max-0902 模型,這是之前剛出沒多久的 Qwen3.8-Max 後訓練升級版,基底完全一樣,聚焦編程與協作(cowork)任務。發布當天獨立評測平台 Arena.ai 的 Code Arena 前端編程(WebDev)總榜立刻更新,Qwen3.8-Max-0902 表現一舉超越 Claude Opus 5 與 Kimi K3 等頂尖閉源模型。
Qwen3.8-Max-0902 Code Arena 登頂:1691 分壓過兩大閉源旗艦
根據 Arena.ai 公布的數據,Qwen3.8-Max-0902 在 Code Arena 的 WebDev 類別拿下 1691 分,位居總榜第一。這個分數比 Claude Opus 5(Max)高出 3 分、比 Kimi K3(Max)高出 17 分,也比前一代的 Qwen3.8-Max 提升 22 分。
Code Arena 是 Arena.ai 旗下以真實工程任務為導向的評測平台,WebDev 類別專門測試模型在網頁前端開發上的實際完成度。能在這類強調實戰的競技場拿下第一,意義不只是基準測試的數字,而是模型在真實開發工作中端到端交付能力的驗證。
這不是 Qwen 系列首次在 Code Arena 有亮眼表現。此前的 Qwen3.8-Max 初版就已在官方對外揭露的資料中,宣稱在 Frontend Code Arena 拿下第四名,而這次的 0902 後訓練版本直接把排名推進到第一,顯示阿里巴巴在編程任務上的迭代節奏相當快。對照先前透過 QwenCloud 提供的另一款 Qwen3.8-Flash,主打較低的訓練成本,0902 則選擇在既有旗艦架構上持續加碼編程與協作能力,兩者形成不同的市場定位。
規格:2.4T 參數、百萬上下文、編程與協作後訓練
Qwen3.8-Max-0902 承襲 Qwen3.8-Max 的架構基礎,具備 2.4T 總參數(95B 活化參數)與 100 萬 token 的上下文長度,是一組針對編程、專業辦公與長時程(long-horizon)任務最佳化的 MoE 模型。0902 版本在此基礎上進一步針對編程與協作任務做後訓練,並於 9 月 2 日透過 QwenCloud API 正式上線。
定價策略:以更低價格提供更高排名
在定價上,Qwen3.8-Max-0902 採取親民路線。阿里巴巴雲端 Model Studio 的公開報價顯示,多數區域每百萬 token 輸入 1.65 美元、輸出 4.951 美元,新加坡區域則為輸入 2 美元、輸出 6 美元,綜合均價約 5 美元。
這個價格策略的競爭力相當明顯。對照 Code Arena 榜單上位居第二、第三的閉源模型,綜合均價分別為 20 美元與 12 美元,Qwen3.8-Max-0902 以約四分之一到三分之一的花費,提供了排名更高的編程表現,在 CP 值上形成壓倒性優勢。阿里巴巴也在官方部落格開放 Qwen3.8-Max 的權重,並允諾開源,讓這款模型除了 API 之外,也能在自管環境部署。
這款新模型已經上線阿里巴巴的千問 AI 平台,並同步接入千問辦公、Qoder 與千問 APP,讓一般使用者與開發者能透過多個入口立即使用。企業與開發者則可經由阿里巴巴雲端的 Model Studio 與 QwenCloud 兩個管道串接 API。
開源與自主部署的平衡
Qwen3.8-Max 系列的定位,是讓開源模型有能力在真實工程任務上和閉源頂尖模型一較高下,同時以更具競爭力的價格提供服務。官方部落格強調,模型在編程、量化研究、晶片設計、電商營運等多元場景都展現了長時程自主工作的能力。
結語
Qwen3.8-Max-0902 登頂 Code Arena WebDev,象徵開源模型在前端開發競技場再次證明自己的實力。對開發者而言,這款模型提供的核心價值有兩層:一是以更低的價格取得更高的編程排名,讓過去只有大型企業才負擔得起的頂尖模型能力,下放到一般團隊也能使用;二是開放權重搭配雲端 API 的雙軌模式,讓想深度掌握模型的團隊能自管部署,想省事的團隊能直接串接雲端服務。
不過現階段還有些變數值得追蹤。首先,0902 在官方文件上仍以 qwen3.8-max 的名稱提供,獨立 SKU 與計價尚未完全確立,實際採用前需要確認所使用的模型 ID 與計價規則。其次,Code Arena 的榜首成績反映的是前端開發這個面向,模型在後端、資料科學、維運等其他編程類別的實際表現,仍需更多評測與使用者回饋來驗證。




