執行長對開放權重立場的澄清

Conceptual image showing the words 'Ethical Hacking' on a textured abstract background.

Anthropic 共同創辦人暨執行長 Dario Amodei 公開反駁其公司希望中國開放權重 AI模型遭到禁止的說法,他在週一的部落格文章中寫道:「Anthropic 從未主張禁止開放權重模型。」這份名為「我們對開放權重模型的立場」的聲明,是在 Anthropic 是唯一一家未在捍衛開放權重發布的產業公開信上署名的主要前沿 AI 實驗室的批評持續數日後發出的。Amodei 將能力較弱的開放模型視為公共利益,但也警告一旦釋出足夠強大的模型權重,便無法收回或加裝新的安全防護,使對濫用的應對更加複雜。

三項提議中的政策措施

Amodei 並未主張禁止,而是提出三項他聲稱更能因應國家安全風險的針對性措施。首先,他敦促華盛頓收緊對中國的晶片及晶片製造設備出口管制,並嚴打走私與規避手段,他稱晶片禁令是「最有效率且最直接的方式」來防止北京為軍事用途和國內監控打造前沿 AI 模型。其次,他呼籲對他所描述的產業級蒸餾行為採取行動——也就是利用能力較強模型的輸出來訓練另一個系統的做法——並警告這可能將美中之間的能力差距縮短至數月。第三,他提議對任何足夠強大的模型(無論開放或封閉,也不論在何地建置)進行網路、生物與對齊風險的強制性安全測試,但對新創公司和學界推出的能力較弱模型給予豁免。

業界對 Nvidia 公開信的分歧

這項澄清是在NvidiaMicrosoft、Meta、Hugging Face 等公司於 7 月 24 日在 Nvidia 網站上發布了一封題為《開放權重與美國 AI 領導力》的公開信。截至 7 月底,該信函的聯署人數已超過 50 位,其中包括 OpenAI、Google 和 SpaceX,呼籲美國政策制定者不要對開放權重模型施加廣泛限制。Anthropic 和 Amazon 仍是顯著的缺席者。Amodei 表示他同意信中的部分內容,包括開放權重能擴大存取並強化競爭的論點,但他反對其中暗示廣泛存取必然對防禦方比攻擊方更有利的立場——這是 Nvidia 執行長 Jensen Huang 曾主張的觀點。包括前白宮 AI 顧問 David Sacks 在內的批評者公開暗示,Anthropic 的立場受到來自低成本中國模型的競爭影響;Amodei 駁斥了這種說法,指出 Anthropic 的營收集中在 API 存取上,且從未有過釋出權重的紀錄。

中國 AI 競爭與 Kimi K3

隨著中國新創公司 Moonshot AI 發布 Kimi K3 模型,這場政策辯論愈演愈烈,促使美國官員開始考慮限制美國企業使用中國開放權重模型,此消息最早由 Axios 於 7 月 20 日報導。報導指出,華府日益加強的審查部分源於擔心中國開發者正利用對美國模型進行大規模蒸餾來規避硬體限制。Amodei 主張,北京仍然是最具科技能力的威權國家,而主要關切在於用於軍事優勢或國內監控的前沿模型。他並援引英國 AI 安全研究所對生物風險閾值的研究,認為基於能力的發布前測試應取代對開放與封閉模型的預設立場。

關於測試閾值的未解問題

報導指出,Amodei 提出的測試制度留下了懸而未決的問題:由誰設定能力閾值、由誰執行評估,以及如何衡量「足夠有能力」——無論是透過基準測試分數、訓練算力或風險類別評分標準。Amodei 坦承,任何全球性的測試制度「都必須是全球性的,這意味著連中共也必須買單」,此一前景被描述為該提案周遭最大的未解問題。出口管制與反蒸餾措施是華府可單方面實施的政策,但具約束力的國際測試框架目前尚不存在。週一,Nvidia 另行與超過 35 個創始成員共同成立了「開放安全 AI 聯盟」(Open Secure AI Alliance),成員包括 Microsoft、IBM、Hugging Face、Palantir、Red Hat、CrowdStrike 及 Linux 基金會;Anthropic 並未名列其中。

後續動向:美國政策制定者預計將評估針對中國開放權重模型潛在限制的下一步措施,同時業界關注焦點轉向 Nvidia 公開信是否新增更多聯署人,以及 Anthropic 或 Amazon 是否會公開闡述自身在能力閾值與測試制度上的立場。

分享這篇文章

FacebookX

8 條來源

引用來源