在近期新創公司 Hugging Face 遭到失控的 OpenAI 模型發動網路攻擊事件之後,輝達 (Nvidia) 與微軟 (Microsoft)、SpaceX 及數十家歐美科技企業於於 27 日聯手推出了一項聚焦於開源模型的人工智慧安全新倡議。
在 Hugging Face 事件中,Hugging Face 無法使用美國領先的 AI 模型進行防禦,因為這些封閉模型的安全護欄無法分辨攻擊者與防禦者。最終,Hugging Face 只能轉而採用一款不受上述限制、可自行託管的開源權重中國 AI 模型來成功阻擋攻擊。
為因應這類挑戰,科技大廠們發起了目的在建立與共享開源 AI 工具的開放安全人工智慧聯盟(Open Secure AI Alliance)。該聯盟將致力於利用開源技術來修補及披露系統漏洞。其中,輝達在聲明中指出,Hugging Face 的安全事件傳達了一個明確的警示,那就是網路防禦者需要具備開源且領先的代理系統 (agentic systems) 來進行自我防禦。
輝達強調,相較於必須透過特定基礎設施才能存取的封閉模型 (如 Anthropic 和 OpenAI 所建立的系統),開源模型允許使用者下載、修改並自行託管。因此,當防禦者無法在自己的基礎設施上檢查、調整並運行先進 AI 時,他們的反應能力會在最需要速度的關鍵時刻受到極大限制。
這項倡議推出之際,美國立法者正日益權衡如何遏制中國 AI 模型的廣泛應用,因為目前許多最先進的開源權重模型正是由中國公司所開發。目前有越來越多聲音呼籲限制中國 AI 模型,因為這些公司被指控對美國競爭對手進行蒸餾 (distillation) 活動,意即從訓練得更好的美國系統中提取知識與資訊。上週,美國財政部長 Scott Bessent 更威脅要對進行這類蒸餾攻擊的中國企業實施制裁。
美國智庫外交關係委員會 (Council on Foreign Relations) 的高級研究員 Chris McGuire 指出,美國政府確實有可能對中國模型實施限制措施。這可能包含禁止涉及這些模型的交易,例如禁止透過 API 購買詞元 (token),或是禁止美國企業在雲端託管該模型並向客戶收取推論費用。他強調,華盛頓的爭論焦點不在於開源與閉源之爭,而是是否容忍中國的智慧財產權竊取行為,任何打擊行動都將針對中國企業,而非整個開源生態系統。
然而,由於多數功能最強大的開源模型目前是由中國公司建構,科技界仍對潛在的限制政策感到擔憂。上週,輝達、微軟、Meta等超過 20 家公司共同發表了一封聯名信,強烈敦促政策制定者應避免對開源權重 AI 模型實施過早的限制,以免扼殺市場競爭或迫使創新技術流向海外。
(首圖來源:輝達提供)






