釋出內容

A woman using a laptop navigating a contemporary data center with mirrored servers.

阿里巴巴 Qwen 團隊已以 Apache 2.0 授權釋出 Qwen3.8 模型家族的開源權重,權重發布於 Hugging Face 與 ModelScope。核心釋出為 Qwen3.8-27B,是一款具備 270 億參數的稠密多模態模型,同時還包括一款規模更大的 Max 層級模型 Qwen3.8-2.4T-A95B,該模型由團隊建構以在 Max 層級運作。

27B 模型的功能

根據 Qwen 說明,Qwen3.8-27B 在程式撰寫與辦公任務上表現優於規模更大的 Qwen3.7-Plus,並定位於消費級硬體上的本地推論,鎖定約 24GB VRAM 的配置,例如 NVIDIA RTX 4090。該模型原生支援處理文字、影像與影片——包含圖表、文件及多小時影片——並支援自動化影片分析、視覺問答、含圖表的文件理解,以及可解讀螢幕截圖的多模態程式助理等應用情境。它也提供更佳的代理行為,具備更獨立的規劃能力與更可靠的任務完成度。

上下文長度與運作模式

Qwen3.8-27B 原生支援最高 262,000 個 token 的上下文,並可透過 YaRN 方法擴展至一百萬個 token。預設啟用彈性思考模式,但可依每次查詢切換。具備一百萬 token 上下文的託管版本預計將透過 Qwen 雲端(阿里巴巴的 AI 服務)釋出。

較大的 Max 等級版本

除了 27B 模型外,團隊也釋出了 Qwen3.8-2.4T-A95B 的權重,該模型具備2.4 兆的總參數,任意時刻約有 950 億個參數處於啟用狀態。該變體主要面向企業級、多節點資料中心部署,而非本機使用,其開放權重的釋出也將相同的Apache 2.0授權條款延伸至整個產品線的最高階版本。

轉向開放權重的策略性轉變

在 Qwen3.8 發布之前,有數個 Max 等級的 Qwen 模型僅以專屬授權方式提供。在 Apache 2.0 下同時釋出 27B 與 Max 等級權重,標誌著回歸到早期 Qwen 版本所採用的開源策略。本機部署可免除對雲端的依賴、降低延遲、將敏感資料保留在本地,並減少實驗成本——這些因素對於受監管產業(如醫療與金融)的新創公司尤其重要,因為本機推論往往是合規上的必要條件。

仍不明朗之處

Qwen3.8-27B 於 2026 年 8 月 3 日首次公開,截至 2026 年 8 月 14 日,Max 等級權重已可供下載;相關報導指出,較小的 27B 模型當時尚未正式上架發行頁面,社群消息來源則指其預定於稍後發布。Qwen Cloud 所託管的百萬 token 版本之確切上線時間,除 Qwen 團隊表示「即將推出」外,並未進一步說明。

分享這篇文章

FacebookX

3 條來源

引用來源