Qwen3.8-Flash 的發布及其定價

Detailed shot of microchips on a circuit board, showcasing electronic technology and precision engineering.

阿里巴巴的 Qwen 團隊於 2026 年 8 月 26 日發布了 Qwen3.8-Flash,這是一款多模態Mixture-of-Experts 模型,圍繞每個 token 的成本打造,並同時針對一款名為 Qwen3.8-Flash-Next 的姊妹版本釋出開源權重。Qwen 表示,透過其應用程式介面(API)存取時,將對每百萬個輸入 token 收取 1 元人民幣(約 0.1488 美元),每百萬個輸出 token 收取 3 元人民幣。該模型支援預設 262,144 個 token 的上下文視窗,可擴展至 100 萬個 token,Qwen 表示這使其能夠處理大型檔案、長對話以及大量的研究資料。Qwen 表示,與其前一代的 Qwen3.7-Plus 模型相比,Qwen3.8-Flash 的訓練成本僅需約九分之一。

架構細節與 Qwen4 定位

Qwen3.8-Flash-Next 將一個 125B 的主模型與 51B 的 N-gram 嵌入參數,以及一個 4B 的多 Token 預測模組結合,在磁碟上共計 180B 參數,但每個 Token 僅啟動 6B 參數。此次釋出帶來四項變革:結合 Gated DeltaNet 與 Qwen Sparse Attention 的混合注意力層、Gated Residual 分支結構、N-gram 嵌入表,以及 Muon 優化器與 AdamW 並行應用於特定權重類別。FP8 checkpoint 為 172.78 GiB,BF16 checkpoint 為 335.28 GiB,在 GB300 上以 TP2 作為最低驗證的 FP8 設定,建議使用 TP4。Qwen 將此次釋出定位為將支撐 Qwen4 的架構早期預覽,這與 Qwen3-Next 對 Qwen3.5 所扮演的角色相同。

策略背景

阿里巴巴將 Qwen3.8-Flash 定位為在降低訓練成本的同時,提供更強的程式碼與辦公任務表現,並開源釋出 Qwen3.8-Flash-Next 的權重,讓開發者能評估 Qwen 表示將作為其下一代 Qwen4 模型家族雛形的架構。此外,根據當日市場反應的一份報導,阿里巴巴股價在 2026 年 8 月 26 日模型發布後上漲 2%。此次釋出正值 AI 成為阿里巴巴營收成長的最大驅動力之際,而中國國內 AI 領域的競爭正日益加劇。

分享這篇文章

FacebookX

4 條來源

引用來源