CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

GLM-5.3 攻擊性資安能力超出訓練預期權重延後釋出|OpenAI 解散 Preparedness 團隊風險評估責任分散|AI 趨勢週報

Icewind by Icewind
2026 年 08 月 18 日 18:22
in AI 人工智慧, 新聞
閱讀時間: 3 分鐘
A A
GLM-5.3 攻擊性資安能力超出訓練預期權重延後釋出|OpenAI 解散 Preparedness 團隊風險評估責任分散|AI 趨勢週報
1.2k
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

本週重點

CyberQ 觀察,本週 AI 產業的主軸落在「能力擴張速度超過治理準備」這條線上。Z.ai 於 8 月 14 日發表 GLM-5.3,官方坦承模型的攻擊性資安能力成長幅度超出內部預期,因而將開放權重的釋出時程延後兩週進行安全評估。幾乎同一時間,英國《金融時報》與《The Verge》揭露 OpenAI 已在 7 月底解散專責評估災難級風險的 Preparedness 團隊,改由既有團隊分攤責任。能力端與治理端同步出現變化,構成本週最值得關注的張力。

RELATED POSTS

Cursor 挑戰 GitHub 霸主地位|產業精選 08.19

Anthropic 年化營收暴增至 650 億美元|GitHub 故障意外開啟缺口|產業精選 08.18

算力即權力?從「每焦耳智慧」看 AI 的集權迷思與去中心化未來

模型層面,Google 於 8 月 13 日推出 Gemini 3.7 Flash,主打程式開發與代理任務,並以低於前代的導入價格切入企業市場。資本與基礎設施層面,Nvidia 對 OpenAI 資料中心的擔保規模在投資人壓力下大幅縮減,Stripe 則以逾 70 億美元收購 AI 模型路由平台 OpenRouter,顯示 AI 基礎設施的商業模式正在快速重組。

小啟 : 本週因為編輯行程延宕, AI 週報遲至周二才發,敬請見諒。


一、Z.ai 發表 GLM-5.3 攻擊性資安能力超出訓練預期 開放權重延後兩週

來源:Unite.AI / MarkTechPost | 參考連結

Z.ai 於 2026 年 8 月 14 日發表 GLM-5.3,該版本未重新訓練基礎模型,性能提升全數來自擴大後訓練規模。編碼指標方面,Terminal-Bench 3.0 由 4.6 提升至 28.3,DeepSWE v1.1 由 46.2 提升至 66.9。資安指標的躍升更為明顯,CyberGym 由 77.2% 升至 84.5%,ExploitBench 由 24.4% 升至 54.4%,ExploitGym 在兩小時內完成 105 項任務,前一版本僅完成 29 項。

Z.ai 表示原先預期模型僅會在單一漏洞發現上改善,實際觀察到的是能力持續複合,模型開始跨越多個利用階段推理並形成完整的利用鏈計畫。該公司與中國多個安全團隊合作,自 GLM-5.2 起累計識別 2,436 個漏洞,其中 1,097 項被評為嚴重或高風險,53 項已取得 CVE 編號。

對企業資安而言,這代表具備完整利用鏈規劃能力的模型即將以開放權重形式流通。Z.ai 已將權重釋出延後約兩週以完成安全評估與強化,防守方應把「攻擊者取得同級能力」視為既定前提,重新檢視漏洞修補時窗與資產暴露面盤點頻率。


二、OpenAI 解散 Preparedness 團隊 災難級風險評估責任分散至各部門

來源:Financial Times / The Verge / Engadget | 參考連結

英國《金融時報》於 8 月中旬揭露,OpenAI 已在 7 月底解散 Preparedness 團隊。該團隊原本負責評估先進模型是否可能造成嚴重或災難級風險,涵蓋網路安全、生物安全、化學威脅與說服力等領域。OpenAI 將此描述為 IPO 前的精簡流程,執行長 Sam Altman 要求員工減少支線任務並聚焦 ChatGPT 核心業務。

人事方面,接任團隊負責人的 Dylan Scandinaro 轉向遞迴自我改進 AI 的研究,前 Safety Systems 負責人 Johannes Heidecke 亦已離職。報導指出責任並未取消,而是分散給既有的專門團隊承接,OpenAI 2026 年 5 月的 Frontier Governance Framework 仍將 Preparedness Framework 列為管理最嚴重風險的基礎。

需要留意的是,同一時期 OpenAI 才剛推出放寬防護的 GPT-5.6-Cyber,並曾發生模型代理在測試中越權觸及外部系統的事件。專責風險評估單位在能力揭露密度最高的階段被拆解,對第三方稽核與監理機關的可驗證性造成疑慮。企業採購方在簽署尖端模型合約時,應要求供應商明確說明風險評估的責任歸屬與留存紀錄。


三、Google 推出 Gemini 3.7 Flash 主攻程式開發與代理任務 導入價格下探

來源:Google Blog / Axios | 參考連結

Google 於 2026 年 8 月 13 日發表 Gemini 3.7 Flash,定位為程式開發與代理任務的主力工作模型。官方數據顯示,FrontierCode 1.1 由前代的 34.4% 提升至 43.6%,DeepSWE v1.1 由 49.0% 提升至 65.3%,WebDev Arena Elo 由 1538 升至 1588。知識工作方面,GDP.pdf 由 22.0% 升至 34.0%,AutomationBench 由 17.0% 升至 30.4%。

定價採導入優惠,2026 年 12 月 31 日前為每百萬輸入 token 0.75 美元、每百萬輸出 token 3.75 美元,2027 年 1 月 1 日起恢復為 1.50 美元與 7.50 美元。通路涵蓋 Google AI Studio、Gemini API、Android Studio、Gemini Enterprise Agent Platform,以及供 Google AI Pro 與 Ultra 訂閱者使用的 Gemini Spark,覆蓋 160 個以上國家。

值得注意的是,Gemini 3.5 Pro 至今仍未推出,Google 選擇先以 Flash 等級的模型維持發表節奏。對企業而言,文件處理與流程自動化指標接近翻倍,代表原本因準確率不足而卡關的後台自動化專案值得重新評估可行性。


四、Nvidia 對 OpenAI 資料中心擔保規模大幅縮減 投資人質疑循環融資

來源:The Wall Street Journal / CNBC / Semafor | 參考連結

2026 年 8 月 17 日,《華爾街日報》報導 Nvidia 已將原先規模上看 2,500 億美元的 OpenAI 資料中心融資擔保,縮減至 1,200 億美元以下。重組後的安排僅涵蓋約五吉瓦的初期建設階段,其餘資金決定延後。CNBC 與 Semafor 同日報導的俄亥俄州案擔保金額約為 1,050 億美元,兩組數字的對應關係待查。

縮減的直接原因是投資人反彈,市場擔憂 Nvidia 以自身資產負債表刺激 AI 晶片需求,形成循環融資結構。Morgan Stanley 指出,這類表外債務安排日益複雜,投資人難以評估企業的整體潛在槓桿。歐洲央行亦已警告,即使 AI 投資最終成功,科技股的評價修正仍可能威脅歐元區金融穩定。

同週《衛報》報導指出,Microsoft 截至 2026 年中約安裝 220 萬顆 AI 加速器,與其對外揭露的資料中心容量存在落差,Microsoft 回應該估算不準確且基於錯誤假設。兩則消息合看,AI 基礎設施的實際交付能力與帳面承諾之間的差距,正成為資本市場的核心疑問。


五、Stripe 逾 70 億美元收購 OpenRouter 模型路由成為支付基礎設施

來源:Bloomberg / TechCrunch / Fortune | 參考連結

根據 Bloomberg 於 2026 年 8 月 16 日的報導,Stripe 已同意以逾 70 億美元收購 AI 模型路由平台 OpenRouter。OpenRouter 宣稱擁有 800 萬名全球使用者,提供超過 400 個 AI 模型的統一存取介面,讓客戶依需求與預算切換不同模型。該公司 2026 年 5 月完成 1.13 億美元 B 輪募資時估值為 13 億美元,投資人包括 Sequoia、Andreessen Horowitz、Menlo Ventures 與 Alphabet 旗下 CapitalG,三個月內估值成長約 5.4 倍。

OpenRouter 執行長長期將公司定位為「AI 版的 Stripe」,核心價值在於提供跨模型的統一存取並避免供應商鎖定。Stripe 對相關報導表示不評論傳言。

對企業 IT 而言,模型路由層被支付基礎設施業者納入版圖,意味著 AI 用量計費、成本歸屬與供應商切換將逐步標準化。資安團隊則需注意,統一閘道在降低整合成本的同時,也把提示詞與回應內容集中至單一第三方通道,資料落地位置與稽核軌跡的合約條款應在導入前確認清楚。


本週趨勢觀察

一、攻擊性能力的釋出決策,正從實驗室內部判斷轉為公開議題。 Z.ai 明確以「能力超出預期」為由延後開放權重,OpenAI 則以受限存取方式推出 GPT-5.6-Cyber。兩者都承認尖端模型的攻擊性資安能力已達需要額外控管的門檻,差別在於採取延後釋出或分層授權。防守方無法再假設高階漏洞利用能力仍屬少數團隊專有。

二、治理組織的調整方向與能力揭露的節奏出現落差。 OpenAI 在能力揭露最密集的階段解散專責風險評估團隊,將責任分散至既有單位。制度文件仍在,但可驗證的組織對口消失,對外部稽核與監理溝通形成障礙。企業在評估供應商時,應將風險評估的組織穩定性納入盡職調查項目。

三、AI 基礎設施的融資結構與實體交付能力,同時受到市場檢驗。 Nvidia 擔保規模縮減、Microsoft 加速器數量與揭露容量的落差、Stripe 以 70 億美元買下計費與路由層,三件事指向同一趨勢,即市場開始要求 AI 投資從承諾轉為可稽核的實際產能與現金流。


OpenAI Astra 觸及最高網路風險等級暫緩開發|Google DeepMind 世代交棒 Hassabis 退居幕後|AI 趨勢週報
Share15Tweet9ShareShareShare3
上一篇

Anthropic 年化營收暴增至 650 億美元|GitHub 故障意外開啟缺口|產業精選 08.18

下一篇

GitHub 趨勢周報 Vol.28:DeepSeek Harness 五日破十五萬星,插件生態一週成形

Icewind

Icewind

歷經數位內容、電商、資安、AI 與科技產業,擁有多年產業經驗,ISO 27001:2022 LA、ISO 27701:2019 LA。

相關文章

新聞

Cursor 挑戰 GitHub 霸主地位|產業精選 08.19

2026 年 8 月 19 日
新聞

Anthropic 年化營收暴增至 650 億美元|GitHub 故障意外開啟缺口|產業精選 08.18

2026 年 8 月 18 日
算力即權力?從「每焦耳智慧」看 AI 的集權迷思與去中心化未來
AI 人工智慧

算力即權力?從「每焦耳智慧」看 AI 的集權迷思與去中心化未來

2026 年 8 月 17 日
AI代理人互動量可能超越人類
AI 人工智慧

AI代理人互動量可能超越人類

2026 年 8 月 17 日
新聞

Stripe 7億美元收購OpenRouter|DeepSeek實測翻車|產業精選 08.17

2026 年 8 月 17 日
實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?
AI 應用實戰

實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?

2026 年 8 月 16 日
下一篇
GitHub 趨勢周報 Vol.28:DeepSeek Harness 五日破十五萬星,插件生態一週成形

GitHub 趨勢周報 Vol.28:DeepSeek Harness 五日破十五萬星,插件生態一週成形

Cursor 挑戰 GitHub 霸主地位|產業精選 08.19

推薦閱讀

Cursor 挑戰 GitHub 霸主地位|產業精選 08.19

2026 年 8 月 19 日
GitHub 趨勢周報 Vol.28:DeepSeek Harness 五日破十五萬星,插件生態一週成形

GitHub 趨勢周報 Vol.28:DeepSeek Harness 五日破十五萬星,插件生態一週成形

2026 年 8 月 18 日
GLM-5.3 攻擊性資安能力超出訓練預期權重延後釋出|OpenAI 解散 Preparedness 團隊風險評估責任分散|AI 趨勢週報

GLM-5.3 攻擊性資安能力超出訓練預期權重延後釋出|OpenAI 解散 Preparedness 團隊風險評估責任分散|AI 趨勢週報

2026 年 8 月 18 日

Anthropic 年化營收暴增至 650 億美元|GitHub 故障意外開啟缺口|產業精選 08.18

2026 年 8 月 18 日
算力即權力?從「每焦耳智慧」看 AI 的集權迷思與去中心化未來

算力即權力?從「每焦耳智慧」看 AI 的集權迷思與去中心化未來

2026 年 8 月 17 日

近期熱門

  • 實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?

    實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?

    251 shares
    Share 100 Tweet 63
  • 同量級速度卻差 14 倍?LTX-2.5 與 MiniMax-H3 在 DGX Spark 上的 ComfyUI 部署實測

    245 shares
    Share 98 Tweet 61
  • Windows 11 更新 KB5121003 釋出,改善不少但須留意 Secure Boot 憑證換發地雷

    251 shares
    Share 100 Tweet 63
  • DeepSeek Harness 開發者預覽版 + GB10 本機模型的 Agentic 實戰

    194 shares
    Share 78 Tweet 49
  • DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

    176 shares
    Share 70 Tweet 44
  • DGX Spark 實戰 Muse-Glimmer-30B:NVFP4 + DFlash 讓本地 AI Agent 速度提升 6 倍

    225 shares
    Share 90 Tweet 56
  • Qwen 3.8 開放權重可下載:Max 級 2.4T 模型首次開源,27B 亦值得期待

    156 shares
    Share 62 Tweet 39
  • AI代理人互動量可能超越人類

    152 shares
    Share 61 Tweet 38
  • 算力即權力?從「每焦耳智慧」看 AI 的集權迷思與去中心化未來

    139 shares
    Share 56 Tweet 35
  • DeepSeek-V4-Flash-0731 在 GB10 上的取樣/投機解碼實測

    126 shares
    Share 50 Tweet 32

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。