阿里巴巴推出 2.4 兆參數旗艦大模型 Qwen3.8-Max,下週開放權重
發布時間:
阿里巴巴於 8 月 3 日正式對外發佈新一代旗艦大型語言模型 Qwen3.8-Max,並宣佈將於下週開放該模型的權重。這是自 Qwen 系列模型推出以來,阿里巴巴首度將最高階的 Max 等級旗艦模型對外開源,打破了過去僅開源中小型參數版本的慣例。同步開放權重的還包含較小規模的 Qwen3.8-27B 版本。開發者目前已經可以透過阿里雲 Model Studio、千問 AI 平台(Qwen Studio)以及 Qwen API 等官方管道,直接存取並應用 Qwen3.8-Max 的各項功能。
根據阿里巴巴官方公佈的技術規格,Qwen3.8-Max 採用了稀疏混合專家(Sparse MoE)架構設計,使其總參數量大幅提升至 2.4 兆(2.4T)。透過此架構,該模型在維持龐大參數規模的同時,每次推論運算僅需激活約 950 億(95B)個參數,藉此平衡運算效能與資源消耗。此外,Qwen3.8-Max 支援最高達 100 萬 Token 的上下文視窗,並原生具備多模態處理能力,能夠在單一模型中同時解析與處理文字、影像、影片以及各類複雜的文件格式。
在具體應用能力方面,阿里巴巴特別強調 Qwen3.8-Max 具備進階的自主程式開發與長程任務執行能力。官方在發佈會中展示了一項實際運作案例,顯示該模型能夠在完全無人干預的環境下,自主執行長達約 16 天的軟體工程專案。在該專案中,模型從頭到尾完成了程式碼編寫與測試,最終成功開發出一款名為「oh-my-cli」的自進化智能體框架,並將該專案直接開源發佈於 GitHub 平台。

針對模型的效能評測表現,依據官方發佈的新聞稿數據,Qwen3.8-Max 在多項指標中取得成績。其中在 PaperBench 評測中獲得 93.0 分,在 OSWorld-Verified 取得 86.1 分,並在 CodeArena 評測中名列全球第四。雖然部分素材提及該模型在 Text Arena 排名第五、Vision Arena 排名第二,但這些具體分榜名次尚未獲得官方新聞稿的完全交叉確認。
隨著 Qwen3.8-Max 的正式上線,阿里巴巴同日也推出了名為「千問辦公(QwenWork)」的全新 Agent 產品,並已將 Qwen3.8-Max 核心能力接入該系統中,以支援企業級的辦公自動化需求。在 API 服務的計價模式上,官方針對不同市場發佈了區域性定價標準。中國國內市場以人民幣計價,每百萬 Token 的輸入費用為 12 元、輸出為 36 元、快取為 1.5 元;海外市場則採用美元計價,每百萬 Token 的輸入費用為 2 美元、輸出為 6 美元、快取為 0.25 美元。


