位居中國開源權重領域頂端的旗艦模型

阿里巴巴發表了 Qwen3.8-Max,將其描述為該公司打造過最大、效能最強的人工智慧模型,擁有 2.4 兆個參數。公司直接將其與國內對手 Moonshot AI 的 Kimi K3 進行比較;Kimi K3 具備 2.8 兆個參數,並於前一個月推出。在群眾外包的 Arena.AI 平臺上,Qwen3.8-Max 成為排名第一的中國文字模型,並在視覺分析排行榜上名列全球第二,僅次於一個「Anthropic」的 Claude 變體版本。
專為代理工作設計的多模態架構與長上下文視窗
Qwen3.8-Max 是一款多模態基礎模型,可處理文字、影像與影片,每個提示最多可接受 100 萬個 tokens,相當於約 75 萬字。阿里巴巴表示,該模型能處理冗長的文件、影片系列與直播串流,以建構可搜尋的知識庫,並展示了多項任務,例如從螢幕截圖重現軟體應用程式、生成互動式遊戲與教育動畫,以及將二維平面圖轉換為 3D 視覺化。該公司也表示,該模型在一次為期 16 天的自主執行中完成了一個軟體工程專案,但這項說法尚未經過獨立驗證。
混合專家架構以控制運算成本
Qwen3.8-Max 採用混合專家設計,將工作分配給各專門元件,每次請求僅啟動約 950 億個參數。阿里巴巴將這種作法定位為讓超大型模型保持低廉執行成本與快速回應的方式,這在中國開發者強調成本效率與原始規模並重的背景下尤為相關。該模型所處的競爭背景為:Moonshot 暫停了 Kimi K3 的新用戶註冊以保護運算容量,凸顯出強勢的中國模型吸引使用者的速度之快。
透過 Model Studio 與新型職場代理進行分發
該模型透過阿里雲的 Model Studio 應用程式介面向全球開發者提供;同一天,阿里巴巴開放了 QwenWork 的公開測試,這是一個透過網頁與桌面應用程式交付的一站式職場 AI 代理平臺。QwenWork 劍指多個競爭對手的產品,包括騰訊的 WorkBuddy、Moonshot AI 的 Kimi Work、Anthropic 的 Claude Cowork 以及 ChatGPT Work,同時也與圍繞該新模型打造的 Qwen Office 代理整合。阿里巴巴計畫接續在下週推出 Qwen3.8-Max 的「開放權重版本」,並另行開源釋出 Qwen3.8-27B,標誌著在年初將數款近期旗艦版本保持閉源之後,重新回歸對頂級模型進行開源。阿里巴巴的香港上市股票在發布後上漲 7%,當日收盤價為港幣 125.20 元。報導中並未揭露 Qwen3.8-Max 的 tokens 定價。
以開放性作為與封閉式西方實驗室的差異化優勢
Alibaba 選擇公佈參數量並釋出開放權重,與 OpenAI、Anthropic 和 Google 形成對比,這些公司並未揭露其閉源模型的參數量。這種開放做法已成為中國開發者反覆強調的訴求,他們將模型規模與架構的透明度視為吸引開發者並加速採用國產模型的方式。
仍有待觀察
預定於下週發布的開放權重版本,以及即將推出的 Qwen3.8-27B 開源版本,將是下一個可衡量的測試,用以驗證 Qwen3.8-Max 在 Arena.AI 的排名是否在外部開發者能直接執行該模型後仍然成立。目前尚未公佈任何 token 定價,使得相較於 Kimi K3 及西方旗艦模型的成本競爭力在現有報導中仍屬未知。
分享這篇文章







