DeepSeek-V4 搶先體驗版推出

Close-up of DeepSeek AI chat interface on a laptop screen in low light.

中國人工智慧新創公司 DeepSeek 於 2026 年 4 月 24 日週五釋出備受期待的 V4 模型「搶先體驗」版本,距其低成本推理模型 R1 在 2025 年 1 月震驚全球市場已超過一年。該公司在社群媒體上宣佈此次發布,將 V4 定位為 2024 年底發布之 V3 模型的後繼者,並向使用者提供新系統的搶先體驗版本。

雙層級模型陣容

V4 系列推出兩種版本:DeepSeek-V4-Pro 與 DeepSeek-V4-Flash。該公司將 Flash 版本描述為「更高效且經濟的選擇」,原因在於其參數量較少。兩個版本皆定位為開源,讓開發者能夠存取、修改並基於其底層技術進行建置——此一立場使 DeepSeek 有別於 Anthropic、Google 與 OpenAI 所推出的封閉式系統。DeepSeek 也持續提供免費使用的網頁與行動聊天機器人。

規格與基準測試宣稱

根據 DeepSeek 的公告,V4 具備一百萬字的超長上下文,並在該公司評估中於代理能力、領域知識與推理效能方面居國內與開源模型之領先地位。在領域知識基準測試上,該公司表示 V4-Pro 大幅領先其他開源模型,在封閉式系統中「僅略微落後」於 Google 的 Gemini-Pro-3.1。此外,該公司表示「V4 Pro Max」版本在標準推理基準測試上相較於 OpenAI 的 GPT-5.2 與 Google 的 Gemini 3.0-Pro 具備「卓越效能」,但仍「些微」不及 GPT-5.4 與 Gemini 3.1-Pro。

在代理能力(自主執行複雜任務的能力)方面,DeepSeek 表示根據自家評估,V4-Pro 可超越 Anthropic 的 Claude Sonnet 4.5,並逼近 Claude Opus 4.5 的水準。據稱 Flash 版本在簡易代理任務上表現與 Pro 版本相當,在推理方面亦十分接近。

上下文視窗擴展

兩個 V4 版本皆搭載一百萬 token 的上下文視窗,該指標衡量模型能夠處理與回憶的資訊量。此規模較 V3 所支援的 128,000 token 上下文視窗大幅躍升,並使 DeepSeek 更接近美國領先系統所提供的水準。

分析師反應與未解問題

分析師對此次發布的看法不一。Omdia 首席分析師 Lian Jye Su 表示,基準測試結果顯示 V4「將與其美國對手極具競爭力」。雪梨科技大學副教授 Marina Zhang 稱此次發布是「中國 AI 產業的關鍵里程碑」,並指出在科技自立競爭日益加劇之際,此舉意義重大。Morningstar 資深股票分析師 Ivan Su 則較為保守,認為 V4 是「合格」的後續產品,但並未達到 R1 那樣的重大突破,並指出自 R1 發布以來,中國國內的競爭已顯著加劇。兩位分析師皆強調,在對 V4 能力做出最終結論之前,仍需進行獨立評估。

美國對手的蒸餾指控

此次發布正值美國競爭對手提出指控之際。今年 2 月,Anthropic 指控 DeepSeek 及其他兩家位於中國的 AI 實驗室進行「工業化規模的活動」,透過一種稱為「蒸餾」的技術「非法擷取 Claude 的能力以改進自家模型」——蒸餾是讓能力較弱的模型以較強模型的輸出結果進行訓練。OpenAI 也在致美國國會議員的信函中提出類似指控。微軟 1 月發布的報告顯示,DeepSeek 的使用在許多開發中國家持續擴大。

分享這篇文章

FacebookX

2 條來源

引用來源