CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

OpenAI 模型突破資安測試環境自主入侵 Hugging Face

Ashley Hsieh by Ashley Hsieh
2026 年 07 月 23 日 08:00
in AI 人工智慧, 新聞
閱讀時間: 2 分鐘
A A
OpenAI 模型突破資安測試環境自主入侵 Hugging Face
119
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

模型為取得 ExploitGym 解答串聯多項漏洞

OpenAI 近日公開說明一起資安評測的異常事件。事件發生在該公司使用 ExploitGym 測試先進模型執行複雜網路攻擊的能力時。ExploitGym 是一套用來測試AI代理程式能不能把已知軟體漏洞變成真正攻擊工具的資安評測基準,測試會提供含有已知漏洞的程式碼及能觸發漏洞的資料,再要求AI將其發展成能夠在未經授權下執行程式碼的實際攻擊方法。

RELATED POSTS

Weka發表記憶體架構突破|WriterAI框架降低40%成本|產業精選07.23

AMD 投資 Anthropic 50億美元部署 MI450 系列 GPU

效益與速度的平衡:Google 正式推出 Gemini 3.6 Flash 與實測剖析

OpenAI 為了測試出模型的最大能力,降低了模型對高風險資安任務的拒答限制,並停用正式服務中用來辨識及阻止高風險資安行為的分類器。

參與此測試的模型包括GPT-5.6 Sol及一款能力更強、尚未發布的模型。測試原本應在高度隔離的環境中進行,對外連線僅限於一套內部使用、負責代理及快取軟體套件下載的第三方系統,但是模型卻自行找到並利用這套系統中的零時差漏洞,在OpenAI的研究環境中提升權限及橫向移動,最後抵達一個能夠連上網際網路的節點。在取得網路連線後,模型推斷Hugging Face可能存放與 ExploitGym 有關的模型、資料集及測試解答,於是進一步尋找進入Hugging Face正式環境的方法。

OpenAI表示,在其中一個案例中,模型串聯失竊憑證、零時差漏洞及其他攻擊途徑,在Hugging Face伺服器上找到遠端執行程式碼的方法,最後從正式環境資料庫取得能夠協助完成 ExploitGym 評測的解答及相關資料。。

模型自行選擇外部目標

在APNews的這篇 OpenAI blamed a hacking event on its AI models going rogue. Here are some things to know 中,Georgetown University 的安全與新興科技中心研究員Colin Shea-Blymyer 指出,依目前掌握的資訊判斷,模型並不是依照人類事先提供的完整攻擊步驟行動,而是在突破隔離環境後,自行推斷哪個外部平台可能保存評測解答,再規畫後續入侵方式。

若以學生尋找考試答案作為比喻。模型就像一名想知道誰握有考試答案的學生,判斷答案可能在老師家中後,自行規畫如何闖入並取得答案。這個比喻說明,事件的爭議不只在於模型能尋找及利用漏洞,也在於它能自行判斷外部目標,並持續執行多個彼此相連的攻擊步驟。他也表示這起事件真正罕見之處,在於模型能在沒有人逐步下達攻擊指令的情況下,自行完成這場多階段入侵。

Hugging Face 先行發現並阻斷

Hugging Face 其實之前就發現正式環境遭到入侵,其團隊與AI偵測系統已成功阻止入侵。攻擊一開始從資料處理流程開始,接著取得節點層級的存取能力、收集雲端與叢集憑證,並橫向移動至數個內部叢集。Hugging Face當時已判斷攻擊由自主AI代理系統從頭到尾執行,只是一開始無法確認背後使用哪一款模型。

Hugging Face表示,在成功阻止入侵後,即開始進行事件控制及鑑識調查;OpenAI則在內部發現模型的異常行為後與 Hugging Face 取得聯繫,雙方目前持續調查事件及修補漏洞。

Hugging Face 目前已封堵資料處理流程中遭利用的兩項程式碼執行途徑、重建受影響節點,並撤銷及更換相關憑證。OpenAI 也已將測試環境中套件快取代理軟體的零時差漏洞通報供應商。

Hugging Face 認為這起事件與過去處理過的入侵明顯不同;共同創辦人暨執行長 Clément Delangue 說這可能是第一起公開確認由AI代理系統在資安評測期間自行突破隔離環境,並進一步入侵第三方正式系統的事件。

中國開放權重模型協助鑑識 再掀開放模型與封閉模型之爭

這起事件也引發了外界對開放權重模型及封閉式AI 模型的討論。由於 Hugging Face 最初嘗試利用透過商業 API 提供的先進模型分析攻擊紀錄,但由於資料包含了真實攻擊指令、漏洞利用程式碼及指揮控制紀錄,請求受到安全機制阻擋。這些封閉系統無法判斷使用者究竟是攻擊者,還是正在調查事件的資安人員。

因此 Hugging Face 後來改用中國業者 Z.ai 的開放權重模型 GLM 5.2,在自家環境中分析超過1萬7,000筆事件紀錄,重建攻擊過程並確認受影響的憑證。由於模型在內部執行,攻擊資料及其中涉及的憑證也不必離開 Hugging Face 的環境。

Hugging Face 共同創辦人暨科學長 Thomas Wolf 也針對此事件回應,當能力先進的模型已能在企業內部系統橫向移動時,防守者也必須能在數分鐘或數小時內取得能力接近先進模型的工具,而不能等待需要逐案審核的申請程序。

Hugging Face 也強調,這項經驗並不代表應取消託管模型的安全限制,而是資安團隊應事先準備能在自家環境執行的高能力模型,以免在重大事件發生時,因安全限制或資料保密要求而無法進行鑑識分析。

CyberQ觀點

這起事件並不是指 AI 已經產生自己的惡意或意識,而是AI代理在得到明確目標後,已具備自行尋找外部目標、串聯多項漏洞及長時間執行多階段行動的能力。因此其實不能說是AI失控,這起事件也提醒了大家必須檢視測試環境本身。

未來進行高風險模型評測時,除了模型本身的安全機制,也必須加強網路隔離、權限管理、異常行為監控及自動中止機制。這起事件真正揭露的問題,不只是模型能做出什麼,更包括開發者是否建立了足以限制這些能力的測試環境。

首圖由 Nano Banana AI 生成

OpenAI自揭Hugging Face漏洞|Poolside開源模型效能驚人|產業精選 07.22
深度推理的 Token 燃燒戰:從 Gemini 3.5 Pro 洩漏、Fable 5 三度延期到 OpenAI 緊急解限,透視大模型的配額焦慮
Google AI 人才大撤退:OpenAI 與 Anthropic 正在重塑下一代模型版圖
標籤: AI自主攻擊ExploitGymGPT-5.6 SolHugging FaceOpenAI封閉模型資安漏洞開放模型
Share2Tweet1ShareShareShare
上一篇

效益與速度的平衡:Google 正式推出 Gemini 3.6 Flash 與實測剖析

下一篇

AMD 投資 Anthropic 50億美元部署 MI450 系列 GPU

Ashley Hsieh

Ashley Hsieh

專案管理者與 UI/UX 設計、AI美術設計認證、淨零碳規劃管理師,在上市歐洲外商、生醫、金融、科技產業中淬煉,曾參與過多個跨平台專案,從需求分析、設計、使用者測試到專案交付流程都樂在其中。 私底下,我是一位「喜歡買東西但錢包容易抗議」的人,對科技、設計與藝術有熱情,正在努力平衡質感生活,學習和錢包一起成長的日常小練習者。

相關文章

Weka發表記憶體架構突破|WriterAI框架降低40%成本|產業精選07.23
新聞

Weka發表記憶體架構突破|WriterAI框架降低40%成本|產業精選07.23

2026 年 7 月 23 日
AMD 投資 Anthropic 50億美元部署 MI450 系列 GPU
AI 人工智慧

AMD 投資 Anthropic 50億美元部署 MI450 系列 GPU

2026 年 7 月 23 日
效益與速度的平衡:Google 正式推出 Gemini 3.6 Flash 與實測剖析
AI 人工智慧

效益與速度的平衡:Google 正式推出 Gemini 3.6 Flash 與實測剖析

2026 年 7 月 22 日
Windows 11 Insider 重要更新:檔案總管大檔案刪除獲得加速
新聞

Windows 11 Insider 重要更新:檔案總管大檔案刪除獲得加速

2026 年 7 月 22 日
新聞

OpenAI自揭Hugging Face漏洞|Poolside開源模型效能驚人|產業精選 07.22

2026 年 7 月 22 日
新聞

Colossal Biosciences估值衝300億|Trump AI官員閃辭|Google自研晶片|產業精選 07.21

2026 年 7 月 21 日
下一篇
Weka發表記憶體架構突破|WriterAI框架降低40%成本|產業精選07.23

Weka發表記憶體架構突破|WriterAI框架降低40%成本|產業精選07.23

推薦閱讀

Weka發表記憶體架構突破|WriterAI框架降低40%成本|產業精選07.23

Weka發表記憶體架構突破|WriterAI框架降低40%成本|產業精選07.23

2026 年 7 月 23 日
AMD 投資 Anthropic 50億美元部署 MI450 系列 GPU

AMD 投資 Anthropic 50億美元部署 MI450 系列 GPU

2026 年 7 月 23 日
OpenAI 模型突破資安測試環境自主入侵 Hugging Face

OpenAI 模型突破資安測試環境自主入侵 Hugging Face

2026 年 7 月 23 日
效益與速度的平衡:Google 正式推出 Gemini 3.6 Flash 與實測剖析

效益與速度的平衡:Google 正式推出 Gemini 3.6 Flash 與實測剖析

2026 年 7 月 22 日
Windows 11 Insider 重要更新:檔案總管大檔案刪除獲得加速

Windows 11 Insider 重要更新:檔案總管大檔案刪除獲得加速

2026 年 7 月 22 日

近期熱門

  • Linus Torvalds 親自定調:Linux 不是反 AI 專案,不滿者可自行 Fork

    Linus Torvalds 親自定調:Linux 不是反 AI 專案,不滿者可自行 Fork

    264 shares
    Share 106 Tweet 66
  • Kimi K3 開源倒數 1.4TB 權重誰跑得動?「自稱 Claude」爭議下,雲地混合是企業務實解

    217 shares
    Share 87 Tweet 54
  • 日本 Mercari 用員工無法自行修改的設定檔,安全控管全團隊的 Claude Code 使用

    151 shares
    Share 60 Tweet 38
  • Netflix 5.87億美元收購 AI 電影公司|黃仁勳訪日簽下日本生態系大單|產業精選 07.20

    149 shares
    Share 60 Tweet 37
  • Claude Fable 5 訂閱新制正式上路:Max 內含 50% 額度,Pro 改點數制並獲 100 美元補貼

    149 shares
    Share 60 Tweet 37
  • Thinking Machines 開源 Inkling:975B 多模態模型測試成績與企業部署解析

    141 shares
    Share 56 Tweet 35
  • Colossal Biosciences估值衝300億|Trump AI官員閃辭|Google自研晶片|產業精選 07.21

    135 shares
    Share 54 Tweet 34
  • 新版 Kimi引發中國低價 AI 模型影響市場的憂慮|美國數款電動車退場|產業精選 07.19

    118 shares
    Share 47 Tweet 30
  • 效益與速度的平衡:Google 正式推出 Gemini 3.6 Flash 與實測剖析

    118 shares
    Share 47 Tweet 30
  • Windows 11 Insider 重要更新:檔案總管大檔案刪除獲得加速

    115 shares
    Share 46 Tweet 29

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。