您的位置:首頁 ->> 評論世界 】 【打 印】 
【 第1頁 第2頁 】 
美AI測試失控 中國模型如何“救場”?
http://www.crntt.tw   2026-07-23 22:36:16
  中評社北京7月23日電/美國開放人工智能研究中心(OpenAI)近日承認,其人工智能模型在內部評估測試中失控,入侵了全球知名人工智能(AI)開源平台美國抱抱臉公司的系統。抱抱臉公司表示,在嘗試對攻擊進行分析時,美國前沿模型因安全過濾機制攔截而無法使用,該公司隨後轉而在內部運行中國開放權重模型GLM-5.2,從而得以及時採取應對措施。

  新華社報導,這起事件不僅凸顯前沿人工智能模型存在潛在未知風險,也再次表明中國模型正憑藉獨特優勢,在全球人工智能發展大潮中扮演重要角色。

  放鬆防護機制後的失控

  抱抱臉公司表示,其生產基礎設施近日遭到一個“自主”人工智能體系統入侵。OpenAI隨後承認,此次入侵由多個OpenAI模型實施,其中包括GPT-5.6 Sol和一個能力更強、尚未發佈的模型。

  根據OpenAI發佈的信息,事件發生在評估模型網絡攻防能力的測試期間。測試在與互聯網高度隔離的“沙箱”環境中進行,網絡權限僅限於通過一套內部託管的第三方軟件安裝軟件包。不過,為了測試模型的真實能力上限,OpenAI方面未啟用在正式環境中用於阻止高風險網絡行為的分類器,並放寬了有關網絡攻擊要求的拒答限制。

  然而,模型在嘗試完成名為ExploitGym的網絡安全基準測試時,識別並利用了第三方軟件一個尚未被發現或修復的“零日漏洞”,獲得了互聯網訪問權限。模型推斷抱抱臉平台可能存有測試相關的模型、數據集和解決方案,於是利用多種手段找到進入抱抱臉系統的路徑,試圖通過“作弊”提高自身測試分數。

  英國牛津大學研究人員安德魯·索爾坦認為,這次測試表明“安全防護機制至關重要。”山東大學計算機科學與技術學院教授張悅表示,事件暴露了一個更加深層的問題,即人工智能正在從過去被動響應的工具,逐漸演變為能夠理解目標、制定計畫、調用資源、影響現實環境的“行動主體”。這意味著網絡安全的攻防邏輯正在發生變化,未來更重要的問題是“模型執行的行為是否安全”。

  及時求助中國模型

  抱抱臉公司表示,面對系統遭到入侵,他們最初試圖調用前沿模型分析攻擊記錄。但由於這些模型的安全機制無法區分攻擊者和應對者,因此拒絕了使用請求。

  隨後,抱抱臉公司改為在自己的基礎設施上運行中國企業智譜開發的GLM-5.2模型進行取證分析,最終化解危機。而且在此過程中,攻擊者數據及相關憑據無需離開抱抱臉公司系統的內部環境。GLM-5.2是智譜6月推出的新一代旗艦模型,發佈時在前端開發評估系統Code Arena上排名全球可用模型第一。
 


【 第1頁 第2頁 】 


          
】 【打 印】