Dario Amodei:我們對開放權重模型的立場

1樓 · 樓主 作者:反賊文摘 釋出於:2026-07-28 22:34 回覆:0 瀏覽:10 本文連結:fanzei.net/d_22252t

我們對開放權重模型的立場 2026年7月27日 Anthropic執行長 Dario Amodei 撰文

過去幾天,關於開放權重模型(open-weights models)——尤其是來自中國的開放權重模型——出現了大量討論。有報道稱,部分美國官員正考慮禁止美國企業使用中國的開放權重模型。作為回應,許多科技公司聯署了一封支援開放權重模型的公開信,甚至有人指責Anthropic企圖禁止開放權重模型,以此保護自身商業利益。凡是讀過我以往文章的人應該都清楚,我並不認為這類禁令是有效的舉措,但在此我想明確表態,以免留下任何疑問:Anthropic從未主張過對開放權重模型實施禁令。

不具備危險能力的開放權重模型是一種公共產品:除了執行它們所需的算力外,幾乎不產生其他成本,同時能為企業、開發者和研究人員創造價值。

保護主義式的禁令並不能解決我最為擔憂的國家安全問題。具體來說,我擔心兩種噩夢般的情形。六個月前,我在《技術的青春期》(The Adolescence of Technology)一文中闡述過這兩點¹,而且多年來我對這一立場始終如一:

我最主要的擔憂,是威權政府——不僅僅是中國共產黨(CCP),儘管CCP顯然是能力最強的威脅——可能構建出比美國更強大的AI模型,並藉此獲取永久性軍事優勢,或對本國人民實施極其深重的壓迫。這一擔憂在美國政府內部得到了廣泛認同:副總統萬斯(Vance)去年在巴黎警告說,"威權政權已經竊取並利用AI來強化其軍事、情報與監控能力";美國情報界釋出的《2026年度威脅評估》也指出,"其他全球大國在AI領域的強勁進展,正在挑戰美國的經濟競爭力與國家安全優勢"。這些模型是否以開放權重形式釋出並不重要,是否被美國企業使用同樣不重要。事實上,最危險的模型很可能是那種在秘密狀態下訓練完成、只交付給中國人民解放軍用於無人機、交付給國家安全部用於監控和鎮壓的模型。 我的第二個擔憂,是強大的AI模型可能被濫用於發起網路攻擊或生物攻擊,並可能存在嚴重的對齊(alignment)問題。開放權重模型——無論來自中國還是其他任何地方——確實可能比閉源模型帶來更高的風險,因為很難對其施加防護措施或監控其使用情況,而且權重一旦釋出便無法收回²。但禁止美國企業使用這些模型,並不能解決這一風險,因為心懷不軌者不太可能是合法的美國企業。這樣的禁令只會讓美國AI公司免於競爭,但這從來都不是我的目標。

為了解決這些問題,我確實支援以下三項措施,這也是我和Anthropic一直以來持續倡導的:

我們不應向中國出售先進晶片或晶片製造裝置,並應打擊目前十分猖獗的走私行為³以及各類用於獲取此類晶片的變通手段。中國本土產能有限,因此根據規模法則(scaling laws),若沒有美國晶片,中國便無法構建出比美國更強大的模型。這是阻止第一種威脅最有效、最直接的方式;同時,由於它阻礙了那些美國法律無法觸及的模型的訓練,這一措施也能間接幫助應對第二種威脅。 我們應當打擊工業化規模的蒸餾(distillation)操作。相較於從零開始訓練模型,蒸餾是一種計算效率高得多的方式,它能讓中國憑藉其晶片數量原本不足以支撐的水平,構建出遠比預期更強的模型,從而部分規避晶片禁令。蒸餾並不能讓CCP獲得與美國相當、甚至超越美國的AI能力,但它能將中國的前沿水平縮小到與美國前沿僅相差幾個月的程度。誠然,從事這類蒸餾操作的許多公司確實釋出了開放權重模型——但與"這些操作背後是一個試圖在前沿領域超越美國的威權國家"這一事實相比,開放權重本身其實無關緊要得多。我們應當出臺政策干預措施來遏制這種行為。對開放權重模型實行全面禁令,既不是正確的解決辦法,也不是我們所主張的⁴。 所有能力達到一定水平的模型,無論開放還是閉源,都應接受強制性安全測試。應對第二種威脅的最佳方式,就是在模型釋出之前,直接測試其在網路安全、生物安全和對齊方面的風險。我認為這一想法實際上已接近共識:一方面,特朗普政府近幾個月已朝這個方向推進,這令我感到鼓舞;另一方面,業界近期也提出了一些提案,主張無論模型來自哪個國家、是開放還是閉源,只要屬於能力最強的一類,就應接受此類測試(同時完全豁免能力較弱的模型,例如來自初創公司和學術界的模型),這同樣讓我感到欣慰。開放模型究竟是否會帶來更高風險、這種風險能否被緩解,應當透過測試得出結論,而不應預先假定——而且,可能已經存在一些有前景的方法,可以提升開放權重模型的安全性,其中包括AE Studio與Anthropic近期在模組化訓練策略方面的合作研究。需要指出的是,要使測試真正有效,就必須在全球範圍內推行,這意味著即便是CCP也需要參與其中。我認為這其實是有可能實現的:正如我在《技術的青春期》中所寫,圍繞防止AI生物武器展開有限度的合作是可能的,因為這同樣符合中國自身的利益。

這就說到了那封公開信。我認同信中的許多觀點:開放權重擴大了進入AI經濟的機會,至少在某些應用場景下增強了競爭,並讓客戶擁有了更大的自主權。關於蒸餾的擔憂,應透過有針對性的法律與商業框架來解決——也就是我在上文提到的那項措施。但我並不認同信中的這一斷言:開放權重模型必然更有利於開發防護措施,或者說能力的廣泛獲取必然更有利於防禦方而非攻擊方。在我看來,情況恰恰相反的可能性至少同樣存在。舉例來說,我擔心生物領域會出現強烈的攻防不對稱:足夠強大的模型或許能夠利用廣泛可得的材料,迅速將大流行級別的病毒武器化,而針對這類病原體的防禦,即便在最理想的情況下,也是一項需要耗時數年的行動(正如我們在"曲速行動"(Operation Warp Speed)中所見)⁵。諸如此類的問題,應當透過釋出前嚴格的實證測試來回答,而不應預先假定答案。

總結一下我和Anthropic的立場:我們過去沒有、現在也不會主張對開放權重模型這一類別整體實施禁令。相反,我們應當把重點放在:防止先進晶片落入威權政府之手、遏制工業化規模的蒸餾操作,以及要求所有能力達到一定水平的模型——無論開放還是閉源——都接受安全測試。

*編者按(7月28日更新):現更新說明,文中提到的有關模組化訓練策略的研究,是Anthropic與AE Studio合作完成的。

全部回覆 (0)

暫無回覆,快來發表第一條觀點吧

發表觀點與回覆