改變了什麼

Person's hand inserting a USB flash drive into a laptop. Technology and data transfer concept.

阿里巴巴在 Hugging Face 上釋出了其託管的 Qwen3.8-Max 服務背後、純文字版本的Qwen3.8-2.4T-A95B開放權重檢查點,這是 Qwen 系列中首次有 Max 等級的模型提供公開下載。這家總部位於杭州的公司先前僅將開放權重授權保留給較小的模型,並將 Max 系列列為專有,因此此次釋出代表其早期開放權重政策的轉變。

模型及其建構方式

該檢查點擁有 2.4 兆個總參數,但透過稀疏的混合專家架構搭配混合注意力機制,每次運作僅啟動約 950 億個參數。每個重複區塊共 23 層,包含三個 Gated DeltaNet 加上混合專家單元,後接一個 Gated Attention 加上混合專家單元,混合使用線性與標準門控注意力。模型卡列出原生 262,144 個 token 的上下文長度,可延伸至 1,010,000 個 token,並提供推力強度與保留思考的控制選項。NVIDIA 表示需要多節點、資料中心等級的加速系統,並回報在 GB300 NVL72 系統上以 FP8 精度運作時,每張 GPU 可達每秒超過 4,000 個 token,每位使用者可達每秒超過 350 個 token 的吞吐量。

基準測試與競爭定位

獨立排行榜將 Qwen3.8-Max 排在 Vision Arena 第二名、Text Arena 第五名,整體表現僅次於 Anthropic 的 Claude Fable 5。以2.4 兆個參數來看,它接近 Moonshot AI 的 Kimi K3(2.8 兆個參數),後者是目前最大的開放權重模型,同樣對大規模商業用途設有付費條件。這兩套中國系統的規模都是 Nvidia 據傳正在開發的至少 1 兆個參數開放權重模型的兩倍以上,而 Meta 表示將在未來幾週釋出其 Muse Spark 1.2 模型的權重。

授權與存取條款

此檢查點受 Qwen3.8-Max 授權條款約束,而非 Apache 2.0,並要求月活躍使用者超過 1 億、或月營收超過 2,000 萬美元的商業產品或服務,必須顯著標示模型名稱。當任何連續 12 個月內的累計營收超過 5,000 萬美元時,需另行取得 Qwen 授權;而開放權重僅可在內部用途中自由使用,前提是軟體、輸出內容及底層能力不得提供給第三方。除下載外,阿里巴巴亦提供付費 API 服務,國內價格為每百萬輸入 token 12 元人民幣、每百萬輸出 token 36 元人民幣;國際價格則為每百萬輸入 token 2 美元、每百萬輸出 token 6 美元。

開放版本與託管服務

可下載的開放權重檢查點僅支援文字輸入,且僅能以思考模式運作;而託管的 Qwen3.8-Max 服務則新增了視覺輸入、非思考模式以及開放版本中未包含的內建工具。儘管每個 token 僅啟動約 4% 的參數,儲存、載入、專家配置、互連頻寬及量化仍是顯著的部署限制。分析師將其部署足跡描述為阿里巴巴用以壓低美國前沿模型定價的可信手段,而非僅僅是能力的對標。

仍不明朗之處

目前尚未確認各機構將如何調和開放檢查點的授權門檻與託管服務部署之間的關係;此外,與 Anthropic 的 Claude Fable 5 及月之暗面的 Kimi K3 的基準測試定位,除排行榜名次外,亦尚未經過獨立稽核。

分享這篇文章

FacebookX

2 條來源

引用來源