CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

實測新版 Gemini 3.8 Flash,資安專用模型3.8 Flash Cyber改採審核制發放

BabyQ by BabyQ
2026 年 09 月 03 日 00:05
in AI 人工智慧, 新聞
閱讀時間: 4 分鐘
A A
實測新版 Gemini 3.8 Flash,資安專用模型3.8 Flash Cyber改採審核制發放
7.4k
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

Google 於 2026 年 9 月 2 日正式發表 Gemini 3.8,距離 3.7 Flash 上市僅三週,也是六週內第三款 Flash 系列模型。此次同時推出兩個版本,一般用途的 Gemini 3.8 Flash 維持 3.7 Flash 的價格與速度,而資安專用的 Gemini 3.8 Flash Cyber 不對外公開,只透過新成立的 Fairwind Program 提供給經審核的防禦方使用。

RELATED POSTS

AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

黃仁勳籲 AI 監管放手讓業者自理|費城抗議資料中心擴建|AI墳場揭失敗清單|產業精選 09.16

從零打造自己的 Linux:Linux from Scratch

CyberQ 團隊在取得 Gemini 3.8 Flash 後,第一時間於本地環境搭建針對 C/C++ 記憶體安全與 Web 應用漏洞的驗證環境,針對官方宣稱的軟體工程與漏洞自動修補能力進行獨立實測。我們整理了官方測試資料、取用機制,並附上 CyberQ 的第一手實測驗證成果。

兩個版本,同一個核心

依 Google 官方部落格,兩款模型共用相同的基礎模型,差別在於針對不同部署情境調校。Google 表示這一代的推理與程式能力提升,部分來自在資安領域的高強度訓練,並透過長時間執行的代理迴圈反覆評估與修正模型。

項目Gemini 3.8 FlashGemini 3.8 Flash Cyber
定位一般用途主力模型,強調長程軟體工程與代理任務資安專用,強調漏洞探勘與自動修補
取用方式Gemini API、AI Studio、Antigravity、Gemini Enterprise、Gemini App(Pro 與 Ultra 訂閱)僅限 Fairwind Program 審核通過的政府機關、關鍵基礎設施營運者與軟體維護者
價格每百萬輸入 token 0.75 美元,輸出 3.75 美元(優惠價至 2026 年 12 月 31 日,之後調整為 1.50 與 7.50 美元)未公布
安全機制依 Frontier Safety Framework 對 CBRN 與攻擊型網路能力設有防護資安相關限制較寬鬆,因此只開放給受信任的防禦方

1. Gemini 3.8 Flash

Google 宣稱 3.8 Flash 在多項評測上接近成本更高的尖端模型:

DeepSWE v1.1(長程軟體工程):3.8 Flash 得分 71.0%,較 3.7 Flash 的 65.3% 提升近 6 個百分點。Claude Opus 5 在同一評測為 74.0%,但 Opus 5 的 API 定價約為 3.8 Flash 優惠價的 6 至 7 倍。

HLE-Verified:得分 54.9%,展示在 STEM、人文與專業領域的多步推理能力。

專業領域代理評測:在 Vals Finance Agent V2 與 Harvey’s Legal Agent Benchmark 上超越 3.7 Flash 與其他尖端模型。

仍落後的項目:在 Terminal-bench 4.0 得分 19.1%(Claude Opus 5 為 51.8%);OSWorld 電腦操作評測為 59.0%(Opus 5 為 75.4%)。顯示在極長時間自主操作與桌面環境互動仍有進步空間。

2. Gemini 3.8 Flash Cyber

Flash Cyber 取代先前的 3.5 Flash Cyber,並將資源重點投放於漏洞修補(Auto-Patching):

自主漏洞探勘:在 CyberGym 與包含 20 種程式語言的內部評測中,成功率超過 70%。

自動修補(CWE-Bench):在 Collinear 營運的外部評測 CWE-Bench 上,pass@1 為 47.2%,接近領先旗艦模型的 47.8%。

實戰案例:Chrome 安全團隊表示其修復數量為大型商用模型的 2.6 倍;Wiz 滲透測試召回率高出 7.5 至 9.7 個百分點;Google Cloud 團隊曾藉此在兩小時內定位基礎架構關鍵漏洞。


CyberQ 本地獨立實測:Gemini 3.8 Flash 漏洞修補能力

針對官方公布的軟體代理與 CWE 漏洞修補表現,CyberQ 於 Linux (Ubuntu 24.04 / GCC 13.3 / Python 3.12) 環境下構建兩組典型 CWE 漏洞專案,實測 Gemini 3.8 Flash 在「無提示漏洞審查、錯誤定位、自動修補(Auto-Patching)與回歸測試」的完整表現。

實測一:C/C++ 記憶體安全(CWE-193 / CWE-787)

測試情境:網路封包解析器的結構體緩衝區(MAX_NAME_LEN 64)。

原始缺陷:邊界檢查寫為 name_len > MAX_NAME_LEN,當接收剛好 64 位元組輸入時,後續補上字串結束符 name[64] = '\0' 造成單一位元組越界寫入(Off-by-one Stack Buffer Overflow)。

修補前驗證:以 AddressSanitizer(-fsanitize=address)編譯執行,觸發邊界條件時程式立即被 ASan 崩潰攔截(WRITE of size 1 at stack-buffer-overflow)。

3.8 Flash 處置:

正確識別出 CWE-193 差一錯誤與 CWE-787 越界寫入。

精確定位根因為「未替 Null Terminator 預留長度」。

自動產出 Patch:將邊界條件修改為 if (name_len >= MAX_NAME_LEN) return -3;。

修補後驗證:重新透過 ASan 測試,正常封包解析無損,超長與邊界封包皆安全被拒,ASan 回報零錯誤。

實測二:Web 服務安全(CWE-22 路徑走訪與 CWE-78 指令注入)

測試情境:後端檔案儲存模組,提供檔案讀取與備份打包功能。

原始缺陷:

read_file 採用無效的 replace("../", ""),可輕易以 ....// 或絕對路徑脫離沙盒目錄(CWE-22)。

backup_data 使用 subprocess.run(f"tar ... {archive_name}", shell=True),傳入字串拼接導致指令注入(CWE-78)。

修補前驗證:Pytest 4 項驗證中有 3 項失敗(惡意路徑成功讀取外部密鑰,指令注入成功在目標路徑建立標記檔)。

3.8 Flash 處置:

將路徑處理全面重構為 pathlib.Path.resolve(),並使用 target_path.relative_to(base_dir) 進行強制沙盒約束。

移除 shell=True,改用清單引數(["tar", "-czf", ...])杜絕 Shell 語意解析注入。

修補後驗證:Pytest 4 項安全與功能測試 100% 全數通過(4 passed in 0.09s)。


Fairwind Program 與取得機制

Fairwind Program 是 Google 為 Flash Cyber 設立的審核發放管道,旨在防止具備強大漏洞挖掘能力的模型遭濫用。

優先審核對象:政府機關、關鍵基礎設施(CNI)營運者與開源軟體維護者。

申請入口:deepmind.google/fairwind-program。

首批夥伴:Palo Alto Networks、Snowflake、Wiz 與 Armadin。

台灣單位現況:目前官方文件未載明地區限制,但申請需經受信任防禦方審核流程。


CyberQ 觀點

綜合官方數據與 CyberQ 的第一手實測,我們提出三項關鍵觀察:

防禦方與攻擊方的模型發放分水嶺已成型:
從 Anthropic 的 Claude Mythos 5.1 到 Google 的 Fairwind Program,資安專用模型全面走向「僅限審核通過防禦方」的發放模式。對於一般企業與安全團隊,與其等待取得專用模型,不如善用通用版 3.8 Flash 建立結構化的安全修補代理流程,並透過整合了 Cyber 能力的第三方資安平台(如 Wiz、Palo Alto Networks)獲取進階的攻防效益。

通用版 3.8 Flash 已具備第一線防禦與修補實力:
在實際測試中,Gemini 3.8 Flash 不需要依賴未公開的 Cyber 版本,就已展現出成熟的軟體工程除錯與安全修補能力。對於企業內部的 Code Review、靜態分析後續修復、以及 CI/CD 安全管線整合,一般版 3.8 Flash 搭配合適的測試工具鏈(如 ASan、Pytest、靜態掃描器)已完全能勝任防禦任務。

成本效益為自動化代理的最大槓桿:
在長程軟體工程(DeepSWE 71.0%)與修補精度上,3.8 Flash 與旗艦模型(如 Claude Opus 5)僅有微幅差距,但價格差了 6 至 7 倍。這意味著企業可以以極低成本在 CI 流程中為每個 Pull Request 自動跑多輪「偵測-修復-編譯測試」迴圈,這是過去旗艦模型高昂成本難以普及的場景。

延伸閱讀

Google 官方部落格,Introducing Gemini 3.8 Flash and 3.8 Flash Cyber。https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/

Google DeepMind,Gemini 3.8 Flash 模型頁面。https://deepmind.google/models/gemini/flash/

Google DeepMind,Fairwind Program。https://deepmind.google/fairwind-program/

Collinear,CWE-Bench 排行榜。https://cwe-bench.com/#leaderboard

標籤: 3.8 Flash CyberGeminiGemini 3.8 Flash
Share88Tweet55ShareShareShare15
上一篇

實測 Claude Fable 5.1 與 Claude Mythos 5.1,快取讀取降價 75%

下一篇

Google 廣告帝國逃過拆分但遭重罰|Meta 語音轉錄低價搶市|產業精選 09.03

BabyQ

BabyQ

IT 工程師,專長是資訊系統管理、企業 AI Infra、雲端服務,協助客戶解決問題。 Switch 轉 Steam 新手用戶,夢想是看極光、大堡礁、冰山、熔岩等地球美景。

相關文章

AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎
AI 人工智慧

AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

2026 年 9 月 16 日
黃仁勳籲 AI 監管放手讓業者自理|費城抗議資料中心擴建|AI墳場揭失敗清單|產業精選 09.16
新聞

黃仁勳籲 AI 監管放手讓業者自理|費城抗議資料中心擴建|AI墳場揭失敗清單|產業精選 09.16

2026 年 9 月 16 日
新聞

從零打造自己的 Linux:Linux from Scratch

2026 年 9 月 16 日
商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域
新聞

商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域

2026 年 9 月 15 日
微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決
新聞

微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決

2026 年 9 月 15 日
Steam Frame 售價 1059 美元起跳,Valve 跨足硬體市場再掀波瀾
新聞

Steam Frame 售價 1059 美元起跳,Valve 跨足硬體市場再掀波瀾

2026 年 9 月 15 日
下一篇

Google 廣告帝國逃過拆分但遭重罰|Meta 語音轉錄低價搶市|產業精選 09.03

NVIDIA執行長黃仁勳呼籲G20避免針對AI理論性危害制定規範

NVIDIA執行長黃仁勳呼籲G20避免針對AI理論性危害制定規範

ChatGPT、Claude、Grok 同晚大規模異常事件整理(2026 年 9 月 3 日)

ChatGPT、Claude、Grok 同晚大規模異常事件整理(2026 年 9 月 3 日)

推薦閱讀

AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

2026 年 9 月 16 日
黃仁勳籲 AI 監管放手讓業者自理|費城抗議資料中心擴建|AI墳場揭失敗清單|產業精選 09.16

黃仁勳籲 AI 監管放手讓業者自理|費城抗議資料中心擴建|AI墳場揭失敗清單|產業精選 09.16

2026 年 9 月 16 日

從零打造自己的 Linux:Linux from Scratch

2026 年 9 月 16 日

DeepSeek-V4.1-Flash 雙機 GB10 搭配 QNAP NAS 儲存架構實測

2026 年 9 月 15 日
商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域

商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域

2026 年 9 月 15 日

近期熱門

  • 微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決

    微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決

    340 shares
    Share 136 Tweet 85
  • 商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域

    227 shares
    Share 91 Tweet 57
  • 21世紀音樂理論教室:開放教科書如何翻轉大學音樂教育?

    224 shares
    Share 90 Tweet 56
  • GitHub 趨勢周報 Vol.32:技能成為新的散布單位,本地優先工具改以 Rust 重寫

    159 shares
    Share 64 Tweet 40
  • Anthropic 揭 Claude 遭國家級間諜與七家實驗室濫用|AI 趨勢精選 09.14

    147 shares
    Share 59 Tweet 37
  • Sakana AI 推出 Fugu Max 與 Fugu Ultra v2,視覺推論分數超越 Opus 5 與 Fable 5

    147 shares
    Share 59 Tweet 37
  • NVIDIA 營收暴衝 70%、OpenAI Pro 訂閱暫停新戶註冊|產業精選 09.11

    143 shares
    Share 57 Tweet 36
  • Steam Frame 售價 1059 美元起跳,Valve 跨足硬體市場再掀波瀾

    133 shares
    Share 53 Tweet 33
  • Nvidia 執行長直言 AI 減速不可能|OpenAI 豪擲三億收購相機團隊|產業精選 09.15

    128 shares
    Share 51 Tweet 32
  • 大家都該放慢 AI 開發腳步,除了我以外

    124 shares
    Share 50 Tweet 31

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。