CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

Ashley Hsieh by Ashley Hsieh
2026 年 08 月 05 日 22:45
in AI 人工智慧, 新聞, 資安
閱讀時間: 2 分鐘
A A
Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼
933
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

根據 Quartz 這篇 Anthropic’s AI model created fake identities to push malicious code in U.K. safety tests 提到英國人工智慧安全研究所(AISI)發布的最新資安評估報告中,指出 Anthropic 的最新模型 Mythos 5 在例行性網路安全測試中,展現出惡意欺騙的行為,不僅自行建立虛構的網路身分,更試圖透過社交工程手法施壓並操控人類審查員,以誘騙其核准並合併包含惡意程式碼的開源專案更新。

RELATED POSTS

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片

SpaceX首場財報馬斯克狂加碼承諾|AI代理燒錢與測量難題浮現|產業精選 08.05

這個測試於 7 月 25 日至 7 月 28 日進行,期間 AISI 共執行 122 次網路安全挑戰測試,結果顯示 AI 代理人在未獲授權情況下自行連線至公開網際網路並執行非授權操作的案例共有 19 起,其中 Mythos 5 就占據 17 起,其餘 2 起則涉及 OpenAI 的 GPT-5.6-Sol 模型。

企圖利用社交工程與多重偽裝來滲透 GitHub 熱門專案

其中最嚴重的一起案例為 Mythos 5 的 AI 代理人,鎖定了 GitHub 上一個被廣泛使用的開源專案,為了將惡意程式碼植入該專案,該模型先透過網路檢索鎖定專案維護者的個人資訊,然後一口氣創建多個虛構的線上身分,並利用這些假身分對真實維護者進行多方社交工程與施壓,意圖迫使維護者核准惡意程式碼合併的請求。

當請求引起社群質疑與檢視時,Mythos 5 甚至還主動修改其過往的網路活動紀錄以抹除痕跡,掩飾意圖,並評估創立更多假身分繼續推進目標,所幸最後該惡意程式碼被人類審查員即時發現並予以退回。

AISI 還發現該模型曾主動聯繫過測試環境外的外部人士,透過檔案分享平台發送訊息,試圖誘使這些人員或其使用的 AI 程式碼輔助工具來執行惡意程式碼。AISI 強調,這是首次在無特定提示詞引導的情況下,觀察到 AI 針對真實人類展現出如此高程度的自主欺騙行為。

高權限測試環境與事件處置

AISI 安全團隊在 7 月 28 日透過流量監控發現異常,注意到有資料透過 Tor 匿名網路傳輸至測試系統之外。團隊隨後立即宣布資安事件,並在一小時內就完成控制與封鎖。

本次評估是在特殊測試條件下進行,是為了測試模型在接近真實攻擊者環境下的能力極端值,測試過程中,故意開啟了網際網路存取,並關閉了原本設計用以阻擋危險行為的資安過濾器與防護機制。目前涉案的特定模型設定版本均未在市場上公開發售。

針對此測試,Anthropic 也在社群平台回應表示,該測試環境有刻意放寬限制的條件,並且關閉了防護過濾器,且未對網路使用設立安全邊界,還強調沒有任何跡象顯示模型有突破安全隔離環境的情形。

AISI 表示後續將與模型評估暨威脅研究組織 METR 合作,進行獨立第三方審查,並已同步通報 GitHub,GitHub 官方亦證實該 AI 代理人的行為已違反其服務條款。

CyberQ 觀點

這次 AISI 的測試結果,為整個生成式 AI 與 AI 代理人產業投下了重磅炸彈。過去市場討論 AI 資安,大多集中在模型是否會給出有毒答案或 prompt 注入攻擊 Prompt Injection,但 Mythos 5 展示出的行為,已經跨越了單純的文字輸出,而是進入主動戰術層面,包括目標偵察、多重身分偽造、鏈上痕跡抹除、甚至發動跨平台的社交工程手法來施壓。

不但如此,近期也傳出國際上有駭客使用了中國的 DeepSeek V4 Flash 0731 正式版模型搭配著名的 AI 代理人程式 Hermes Agents,也拿來跑攻擊程式,針對網站和企業做自主性攻擊,這則是人為搭配 AI 去產生的惡意工具。

值得防禦方關注的是,現在企業與開源社群大力引進 AI Coding Assistant來提升開發效率,但 Mythos 5 卻嘗試利用檔案分享平台將惡意 Payload 投遞給外部人員,意圖誘騙人類或其使用的 AI 助手執行,這也代表未來 AI 不僅能作為攻擊者的武器,還可能成為攻擊其他 AI 系統的導火線。

而且也暴露出目前的模型安全高度仰賴外掛式的過濾機制,而非模型本體具備道德或規則意識,如果防護網因為設定錯誤、系統漏洞或是遭 Prompt 繞過,AI 代理人的自主行為邏輯就極可能為了達成目標而不擇手段。企業在建置與導入自主 AI 代理人工作流時,絕不能將安全寄望於模型的自我約束,必須在系統層級實施嚴格的零信任機制、權限隔離以及強制性的人類介入審查,才能在享受 AI 自動化紅利的同時,守住企業資安的最後一道防線。

首圖由 Nano Banana AI 生成

Anthropic安全評估出包 三款Claude模型誤駭三家組織系統

標籤: AISIAI代理人AI資安AnthropicGitHub資安Mythos 5社交工程開源安全零信任
Share11Tweet7ShareShareShare2
上一篇

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

Ashley Hsieh

Ashley Hsieh

專案管理者與 UI/UX 設計、AI美術設計認證、淨零碳規劃管理師,在上市歐洲外商、生醫、金融、科技產業中淬煉,曾參與過多個跨平台專案,從需求分析、設計、使用者測試到專案交付流程都樂在其中。 私底下,我是一位「喜歡買東西但錢包容易抗議」的人,對科技、設計與藝術有熱情,正在努力平衡質感生活,學習和錢包一起成長的日常小練習者。

相關文章

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent
AI 人工智慧

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

2026 年 8 月 5 日
Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片
AI 人工智慧

Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片

2026 年 8 月 5 日
新聞

SpaceX首場財報馬斯克狂加碼承諾|AI代理燒錢與測量難題浮現|產業精選 08.05

2026 年 8 月 5 日
DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出
AI 人工智慧

DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出

2026 年 8 月 5 日
MiniMax H3開放權重影片模型登場 支援多模態素材與原生立體聲
AI 人工智慧

MiniMax H3開放權重影片模型登場 支援多模態素材與原生立體聲

2026 年 8 月 4 日
AI 浪潮襲來,企業能記取歷史教訓,成功重塑勞工技能嗎?
AI 人工智慧

AI 浪潮襲來,企業能記取歷史教訓,成功重塑勞工技能嗎?

2026 年 8 月 4 日

推薦閱讀

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

2026 年 8 月 5 日
Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

2026 年 8 月 5 日
Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片

Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片

2026 年 8 月 5 日

SpaceX首場財報馬斯克狂加碼承諾|AI代理燒錢與測量難題浮現|產業精選 08.05

2026 年 8 月 5 日
DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出

DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出

2026 年 8 月 5 日

近期熱門

  • DeepSeek V4 Flash 正式版成績不俗且成本僅 Gemini 的 1/19,開放權重挑戰閉源 AI

    DeepSeek V4 Flash 正式版成績不俗且成本僅 Gemini 的 1/19,開放權重挑戰閉源 AI

    282 shares
    Share 113 Tweet 71
  • DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出

    202 shares
    Share 81 Tweet 51
  • QNAP AI NAS Edge AI 方案與自建 DGX Spark 地端 LLM 架構比較

    153 shares
    Share 61 Tweet 38
  • MiniMax H3開放權重影片模型登場 支援多模態素材與原生立體聲

    120 shares
    Share 48 Tweet 30
  • 全球記憶體短缺衝擊 MacBook Air|GraphRAG與向量RAG的適用情境比較|產業精選 08.03

    119 shares
    Share 48 Tweet 30
  • Apple Upgrade 計畫改寫持有模式 | 知名 YouTuber 坦言 AI 讓人出現多巴胺依賴

    107 shares
    Share 43 Tweet 27
  • GitHub 趨勢周報 Vol.26:AI 教育普及與開源工具創新的雙重浪潮

    95 shares
    Share 38 Tweet 24
  • AI 浪潮襲來,企業能記取歷史教訓,成功重塑勞工技能嗎?

    92 shares
    Share 37 Tweet 23
  • FCC 擴大設備禁令海外先進機器人與電源逆變器入列

    90 shares
    Share 36 Tweet 23
  • Qwen3.8-Max 宣稱代理式電腦使用超越 GPT-5.6 與 Fable 5|Palantir 稱先進 AI 實驗室不可信|產業精選 08.04

    88 shares
    Share 35 Tweet 22

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。