此次發布及其意義

2026 年 8 月 14 日,中國社群平臺 Rednote(小紅書)的模型實驗室 Dots Studio 釋出了 dots3 note preview 的模型權重。這次發布是 dots3 系列的首個開放權重模型,與先前在 2026 年國際數學奧林匹亞競賽(IMO)中獲得滿分 42 分的模型屬於同一系列。團隊將此舉定位為與整個產業分享其最新技術方向,並鼓勵各界投入長時程真實世界任務的研究。
模型規格與能力
dots3 note preview 擁有 2800 億個總參數,其中 160 億個為啟動參數,並支援最高達 512K token 的上下文窗口。該模型可處理涵蓋文字、視覺與音訊的多模態理解,並已針對複雜推理與長時程代理任務進行最佳化。在主流基準測試上,Dots Studio 表示,該模型在推理、代理能力與多模態感知方面均位列同類規模中國領先模型之行列,尤其在視覺能力上以該規模而言表現特別突出,並聲稱在多項推理與代理評測中能與甚至超越規模遠大於它的模型匹敵。
為何關注長時程真實世界任務
Dots Studio 主張,長時程真實世界任務將成為大型模型能力的下一個重要前沿,即便業界目前對此關注相對較少。團隊將這類跨越數天至數個月展開的任務——例如規劃旅行、裝修住宅或籌辦婚禮——與答案與回饋較為明確的封閉式任務(如數學與程式設計)進行對比。該工作室表示,為了處理真實世界任務,模型必須理解平面圖、報價單、航班截圖、地圖與語音備忘錄等非文字資訊,並必須在執行過程中持續評估與調整計畫,而非僅在最後才判斷成功與否。
技術方法
根據 Dots Studio 的說明,dots3 note preview 背後的技術方法聚焦於三大領域:更強的多模態理解能力,以處理日常情境中遭遇的多元資訊類型;引入自我批判機制,使長時程任務不再僅仰賴最終結果進行評估;以及為處理跨多日、多步驟規劃而設計的能力,呼應該工作室「為日常生活創造前沿智慧」的使命。團隊先前推出的兩項基準測試以複雜的日常生活情境為核心,當時顯示全球領先模型表現不佳,且無一達到通過門檻,進一步強化了該工作室聚焦此方向的主張。
仍待釐清之處
發布資料強調基準效能與設計理念,但未詳述訓練資料組成、開源權重的授權條款或部署計畫。在所提供的資料中並無獨立的第三方基準重現與下游評測,而 dots3 note preview 與其他同類規模中國模型之間的任何排名宣稱,皆是基於該工作室自行回報的結果。
分享這篇文章







