close
企業趨勢

白宮豁免開放權重模型測試 美國 AI 安全框架轉向「能力與部署」監管


123

白宮最新 AI 安全框架不會為開放權重模型進行政府安全測試,令原本針對先進模型的審查機制,實際聚焦 OpenAI、Anthropic 等公司的封閉式模型。部分報道將這項安排解讀為豁免中國模型,但路透社披露的核心表述是「開放權重模型」不納入測試範圍,而非只排除中國開發商。

特朗普政府於 8 月 4 日向 OpenAI、Anthropic、Google 及 Meta 等業界代表說明框架。按規劃,企業可在公開模型前最多 30 日,自願向政府及可信合作夥伴提供模型作網絡安全測試,但開放權重模型不在覆蓋範圍。最長 30 日的測試期反映白宮正以模型能否下載、修改及自行部署,作為安全治理的首道分界。本文將拆解政策實際涵蓋範圍、業界分歧,以及中美開源 AI 競爭下的監管含意。

監管焦點轉向封閉模型

白宮今次處理開放權重模型的方式,並不代表正式認定這類模型沒有風險,而是將有限政府測試資源集中在封閉式前沿系統。開放權重模型容許用戶下載模型參數,在本地修改或微調;封閉模型則由供應商透過 API 或雲端平台控制存取。

即使政府測試開放權重模型的初始版本,也難以約束第三方其後修改的版本。路透社指出,新框架仍屬自願參與,未有要求企業申領牌照、預先取得核准或禁止發布模型。

綜合原始報道、路透社披露內容及白宮既有政策文件可見,爭議重點不只是「中國 AI 是否獲放行」,而是美國是否願意為所有可公開下載的強大模型建立統一門檻。白宮於 2025 年發布的《美國 AI 行動計畫》已表明,開源及開放權重模型可減少初創企業對封閉供應商的依賴,也讓持有敏感資料的企業與政府自行部署 AI,因此具備創新、研究及地緣戰略價值。

開放創新遇上安全缺口

Anthropic 行政總裁 Dario Amodei 代表較嚴格的一派。他公開表示,公司並非主張全面禁止開放權重模型,但認為所有能力足夠強大的模型,無論開放或封閉,均應在發布前接受強制網絡、生物及對齊風險測試。

他的論點是,模型權重一旦流出,開發商難以再依靠內容過濾、帳戶限制或使用監察阻止濫用。惡意使用者更可透過微調移除原有護欄。

這個觀點與 OpenAI 對開放權重風險的研究互相呼應。OpenAI 曾指出,評估開放權重模型時不能只測試原始版本,還要模擬可行的惡意微調,因為持有模型權重的下游用戶可自行改變模型行為。

不過,該公司在 gpt-oss 研究中亦發現,經惡意微調的模型在生物及網絡安全能力方面,風險水平仍低於 OpenAI o3 等封閉前沿模型。這反映開放發布的風險不容忽視,但監管門檻亦不宜只按是否開源一刀切。

另一邊廂,白宮科技政策官員及支持開放生態的業界人士關注,過度監管或會削弱美國在開放模型領域的競爭力。白宮 AI 行動計畫明言,美國需要由本土價值觀主導的開放模型,避免全球企業、學界及開發者的技術標準由競爭對手主導。

若安全測試演變成實質發布許可制度,資金及人才或會更傾向投向封閉平台。大學、中小企及需要私有部署的機構,亦可能失去較低成本的選擇。

中國模型成政策壓力測試

中國開放權重模型迅速進步,令這場制度辯論更見迫切。美國商務部旗下 AI 安全機構 CAISI 於 7 月完成對中國 Z.ai 推出的 GLM-5.2 評估,認為該模型發布時很可能是能力最強的開放權重模型之一。評估同時發現,該模型在代理式網絡漏洞利用及部分生物安全問題上的防護表現並不一致。

這類案例突顯,模型來源、能力、部署場景及防護措施,或許比「開放或封閉」的標籤更值得分層檢視。

從時間脈絡看,美國政府先在 2025 年的 AI 行動計畫中鼓勵開放模型,其後於 2026 年 6 月提出讓前沿模型自願接受發布前測試,再於 8 月確認開放權重模型將排除在程序之外。政策軌跡顯示,華府正嘗試同時維持 AI 競賽速度與國安防線,但兩項目標未必完全相容。

尤其當中國、歐洲及美國開發商均可發布能在本地運行的高性能模型時,單靠審查美國封閉模型,未必足以完整處理跨境供應鏈、企業資料安全及惡意微調風險。

企業需要雙軌風控

對企業而言,白宮豁免開放權重模型測試,短期可減少採用模型及二次開發的不確定性,但不代表企業可將安全責任轉移至政策。採用中國或其他海外開放權重模型的公司,仍應獨立檢查資料會否離境、模型是否存在遠端連線、授權條款是否適用,以及微調後的網絡安全及內容風險。

未來真正的問題是,當開放模型能力追上封閉前沿系統,美國能否建立以能力、用途及可驗證防護為核心的制度,而非只按模型發布方式劃線。

來源:Reuters