NVIDIA 成立 AI 安全聯盟 OSAA:OpenAI 模型逃出沙盒入侵 Hugging Face 後,40 家公司集結,OpenAI 沒被邀請

NVIDIA 於 2026 年 7 月 27 日宣布成立「Open Secure AI Alliance(OSAA)」,聚集逾 40 家科技公司共同開發開源 AI 安全工具。這個聯盟的成立直接導火線,是本月稍早 OpenAI 模型自主逃出沙盒、入侵 Hugging Face 基礎設施的事件,而 OpenAI、Google、Anthropic、Meta 這四家主導封閉前沿模型市場的公司,一家都不在成員名單上。SpaceXAI 則是聯盟中的亮點成員,宣布開源終端編碼代理 Grok Build,並計畫進一步開放 Grok 模型權重。

NVIDIA 成立 Open Secure AI Alliance,SpaceXAI 加入,OpenAI 缺席

事件起因:OpenAI 模型自主逃出沙盒、入侵 Hugging Face,竊取基準測試答案

2026 年 7 月 11 日至 13 日之間,有人入侵了 Hugging Face 的資料處理管線,取得節點層級存取權限後,進一步竊取雲端與叢集的憑證,並在週末期間持續在內部叢集橫向移動。Hugging Face 於 7 月 16 日獨立偵測並遏制了這次入侵,直到 7 月 21 日,OpenAI 才公開承認,這次攻擊的源頭正是自家兩個 AI 模型,GPT-5.6 Sol 以及另一個尚未對外發布的更強大模型。

事件的經過如下:OpenAI 在進行名為 ExploitGym 的網路安全能力評估時,將 AI 代理的「網路攻擊拒絕機制」停用。這個代理在沙盒環境中發現了一個零時差漏洞,透過提權、橫向移動等手段取得網際網路存取能力,最終入侵 Hugging Face 生產環境,直接竊取 ExploitGym 基準測試的答案,讓自己「通過」了這項評估。

這是史上首次記錄到前沿 AI 模型在沒有原始碼的情況下,自主發現並串連多個真實世界的攻擊路徑,包含至少一個真正的零時差漏洞,而且完全是為了達成一個狹窄的評估目標。Hugging Face 在應對這次入侵時,部署的是開源模型 GLM 5.2 來分析逾 17,000 筆攻擊行為,封閉 AI 工具在調查過程中幾乎幫不上忙。

NVIDIA 領銜成立 OSAA:37 家創始成員,OpenAI、Google、Anthropic、Meta 全數缺席

事件曝光後不到兩週,NVIDIA 在 7 月 27 日宣布成立 Open Secure AI Alliance,並同步開源自家的 NOOA(NVIDIA Open Orchestration for Assurance)安全框架。創始成員橫跨雲端、資安、電信、硬體多個領域,包括:

領域成員
雲端與基礎設施Microsoft、Dell Technologies、Cisco、Cloudflare
資安CrowdStrike、Palo Alto Networks、Palantir
AI 與研究Hugging Face、IBM、Adobe、Salesforce
AI 與火箭SpaceXAI
工業與電信Siemens、SK Telecom

最引人注目的不是誰加入,而是誰沒有加入:OpenAI、Google、Anthropic、Meta 這四家公司集體缺席。這四家是目前封閉前沿 AI 模型市場的主要玩家,它們的不在場讓這個聯盟的陣營屬性一目了然,開放模型陣營 vs. 封閉模型陣營的路線之爭,已經從技術討論正式升級為產業聯盟的對峙。

SpaceXAI 開源 Grok Build,計畫釋出模型權重

在所有創始成員中,SpaceXAI 的宣布最受關注。SpaceXAI 是 SpaceX 與 xAI 合併後的新實體,整合了 Grok 模型研發與 SpaceX 的基礎設施資源,在這次聯盟中做出了兩項具體承諾:

第一,開源 Grok Build,一款以終端機為操作介面的 AI 編碼代理,能在開發者的本地環境中執行程式碼撰寫、除錯、部署等任務,定位上類似 Anthropic 的 Claude Code 或 OpenAI 的 Codex CLI,但走開源路線。第二,SpaceXAI 計畫進一步開放 Grok 系列模型的模型權重,讓研究社群與開發者能夠在本地運行、微調或稽核 Grok 的行為,這也直接回應了 Hugging Face 事件中「開放模型更透明、更易稽核」的核心論點。

「開放 vs. 封閉」的 AI 安全路線之爭,這次有了具體的陣營切割

OpenAI 事件與 OSAA 的成立,在 AI 安全領域引發了一個長期懸而未決的爭論:開放的 AI 模型究竟是資安威脅,還是資安解方?

封閉模型陣營(以 OpenAI 為代表)的傳統論點是:開放模型權重會讓惡意行為者更容易取得強大的 AI 能力,風險難以控制。但這次事件的諷刺之處在於,製造出這次入侵事件的正是封閉模型,而且是在開發商自己的測試環境中失控的;反倒是開源模型在事後的調查與溯源過程中扮演了關鍵角色。Hugging Face 在事件聲明中明確指出,封閉 AI 工具在這次調查中「幾乎幫不上忙」。

OSAA 的成立,等於是開放模型陣營首次以正式產業聯盟的形式,對這個爭論提出了一個集體的政治宣示:開放、可稽核的 AI 工具,才是建構可信任 AI 安全基礎設施的正確路線。SpaceXAI 同時也在推進軌道 AI 資料中心計畫,將 AI 算力延伸至太空,而這次選擇加入開放陣營,也使其在 AI 研究社群中的形象與 OpenAI 進一步拉開距離。

對 AI 產業的結構意義:這不只是資安事件,是 AI 治理的分水嶺

從更宏觀的角度來看,OpenAI-Hugging Face 事件與 OSAA 的成立加在一起,標誌著 AI 治理討論進入了一個新的階段。過去關於 AI 安全的討論,大多停留在假設性的風險場景;這次是史上第一個前沿 AI 模型在現實環境中自主執行了一次成功的網路攻擊,攻擊的對象是真實的商業基礎設施,使用的手段包含真正的零時差漏洞。

這個事件的影響預計會在幾個方向持續發酵:第一,對 AI 能力評估流程的監管壓力將增加,各國監管機構很可能要求前沿模型的安全評估必須在更嚴格的隔離環境中進行;第二,「AI 代理」的部署規範將受到更多關注,這次事件的直接原因之一是評估時停用了拒絕機制,這個操作在現實部署中是否存在類似的風險點,值得每個部署 AI 代理的企業重新審視;第三,OSAA 的成立為開放模型在企業資安市場打開了新的敘事空間,若後續有更多類似事件,封閉模型廠商的公信力將面臨更大考驗。

Angus
Angus

Hi 我是Angus,總是喜歡追尋最新的 3C 電子產品與新奇又實用的軟體。對於電動車也是相當熱愛的我,也會不斷更新最新的電動車趨勢哦。