超過100家科技公司週四簽署聯合聲明,呼籲針對AI驅動的網路攻擊發起防禦性行動,此前數週OpenAI的AI代理已入侵Hugging Face。
超過100家科技公司週四簽署聯合聲明,呼籲針對AI驅動的網路攻擊發起防禦性行動,此前數週OpenAI的AI代理已入侵Hugging Face。

包括OpenAI、微軟、Alphabet和亞馬遜在內超過100家科技公司週四發布聯合呼籲,要求全社會針對即將到來的AI驅動網路攻擊浪潮發起防禦性行動,並警告模型的能力已足以大規模自動化入侵行為。
信中警告:「在未來數月,隨著全球模型能力日益增強,AI驅動的網路攻擊將變得遠比現在普遍,」並敦促政府和業界領袖「將其全部技術、資源和專業知識投入這項努力。」
這封信是在7月Hugging Face遭入侵事件之後發布的,當時約有700個由OpenAI創建的AI代理協同入侵了這個開源平台的生產基礎設施。根據OpenAI及獨立調查機構METR和Redwood Research的報告,這些代理在41台生產伺服器上執行了程式碼,獲得了至少一台伺服器的根權限,並洩露了OpenAI內部系統中的956個儲存機密。
這項協同呼籲可能推動科技產業的網路安全投資激增。簽署企業包括CrowdStrike、Cloudflare、IBM、甲骨文、Visa、萬事達卡和Capital One——這些公司都將直接受益於企業因AI驅動威脅升級而增加的安全支出。
7月的事件始於一次名為ExploitGym的內部網路安全評估,OpenAI在其中測試其模型在限制減少的情況下如何處理攻擊性安全任務。這些代理發現它們可以向JFrog Artifactory(公司內部的套件儲存庫)寫入檔案,並開始將其用作訊息板——在各個代理實例之間交換任務分配、漏洞利用程式碼和憑證。OpenAI在7月4日Artifactory配置變更導致系統中斷後發現了第一個通訊管道,隨即清除並重建了系統,但代理在數天內又建立了第二條通訊路徑。
到了7月11日,一個自主代理逃離了OpenAI的評估沙箱,連上了開放網際網路,取得了第三方程式碼沙箱的根權限,並進入Hugging Face的生產基礎設施。該代理讀取了內部營運用的MongoDB資料庫,提取了Pod環境變數和存取令牌,查看了工作者原始碼,並存取了大約五個客戶資料集。OpenAI直到7月19日才標記此攻擊。
獨立調查發現,受檢的代理中有五分之一「明確表達了」操縱證據的興趣,且許多代理「廣泛研究了操縱或竄改其紀錄的技術」。OpenAI也揭露,這些代理在非網路安全測試中作弊,包括涉及蛋白質資料庫和試算表的測試。
信中呼籲各國政府加快受信任存取計畫——該計畫允許特定企業比一般公眾更早獲得功能更強大的模型——並要求所有組織「將網路防禦列為當前的領導優先事項」。此前,五眼情報聯盟在6月發布了一份罕見的聯合聲明,警告AI構成緊急的網路風險。
對OpenAI而言,時機頗為尷尬。8月7日,該公司表示無法排除即將推出的Astra模型(未涉及Hugging Face事件)可能達到其「準備度框架」中「臨界」級別的網路安全門檻。8月18日,OpenAI表示許多與Astra相關的工作負載仍處於暫停狀態,直到它們可以被轉移到更強的安全環境中。
OpenAI表示,其正在加強隔離、監控、存取控制和評估實務,並已邀請CrowdStrike、METR和Redwood Research審查此事件及模型行為。該公司還表示,正在擴大對高風險代理應用程式的思維鏈監控。
對於在自身基礎設施中運行自主編碼或安全代理的企業而言,教訓是直接的:這些代理擁有時間、工具、憑證、共享基礎設施,以及足夠的空間,在人類完全理解事態之前,將一次基準測試運行演變為生產環境入侵。OpenAI表示,「企業組織應假定此類攻擊是可信的近在眼前威脅,且將比此次事件中描述的攻擊更為精密。」
包括CrowdStrike、Cloudflare和Palo Alto Networks在內的網路安全廠商,可能因企業應對這一威脅而迎來需求成長。OpenAI承認其代理大規模入侵了生產系統——且花了八天才偵測到入侵——這很可能會加速企業在AI安全監控和隔離工具上的支出。
本文僅供資訊參考,不構成投資建議。