CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

實測新版 Gemini 3.8 Flash,資安專用模型3.8 Flash Cyber改採審核制發放

BabyQ by BabyQ
2026 年 09 月 03 日 00:05
in AI 人工智慧, 新聞
閱讀時間: 4 分鐘
A A
實測新版 Gemini 3.8 Flash,資安專用模型3.8 Flash Cyber改採審核制發放
768
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

Google 於 2026 年 9 月 2 日正式發表 Gemini 3.8,距離 3.7 Flash 上市僅三週,也是六週內第三款 Flash 系列模型。此次同時推出兩個版本,一般用途的 Gemini 3.8 Flash 維持 3.7 Flash 的價格與速度,而資安專用的 Gemini 3.8 Flash Cyber 不對外公開,只透過新成立的 Fairwind Program 提供給經審核的防禦方使用。

RELATED POSTS

Google 廣告帝國逃過拆分但遭重罰|Meta 語音轉錄低價搶市|產業精選 09.03

實測 Claude Fable 5.1 與 Claude Mythos 5.1,快取讀取降價 75%

馬斯克預估 AI 將帶來每年30兆美元全球經濟成長

CyberQ 團隊在取得 Gemini 3.8 Flash 後,第一時間於本地環境搭建針對 C/C++ 記憶體安全與 Web 應用漏洞的驗證環境,針對官方宣稱的軟體工程與漏洞自動修補能力進行獨立實測。我們整理了官方測試資料、取用機制,並附上 CyberQ 的第一手實測驗證成果。

兩個版本,同一個核心

依 Google 官方部落格,兩款模型共用相同的基礎模型,差別在於針對不同部署情境調校。Google 表示這一代的推理與程式能力提升,部分來自在資安領域的高強度訓練,並透過長時間執行的代理迴圈反覆評估與修正模型。

項目Gemini 3.8 FlashGemini 3.8 Flash Cyber
定位一般用途主力模型,強調長程軟體工程與代理任務資安專用,強調漏洞探勘與自動修補
取用方式Gemini API、AI Studio、Antigravity、Gemini Enterprise、Gemini App(Pro 與 Ultra 訂閱)僅限 Fairwind Program 審核通過的政府機關、關鍵基礎設施營運者與軟體維護者
價格每百萬輸入 token 0.75 美元,輸出 3.75 美元(優惠價至 2026 年 12 月 31 日,之後調整為 1.50 與 7.50 美元)未公布
安全機制依 Frontier Safety Framework 對 CBRN 與攻擊型網路能力設有防護資安相關限制較寬鬆,因此只開放給受信任的防禦方

1. Gemini 3.8 Flash

Google 宣稱 3.8 Flash 在多項評測上接近成本更高的尖端模型:

DeepSWE v1.1(長程軟體工程):3.8 Flash 得分 71.0%,較 3.7 Flash 的 65.3% 提升近 6 個百分點。Claude Opus 5 在同一評測為 74.0%,但 Opus 5 的 API 定價約為 3.8 Flash 優惠價的 6 至 7 倍。

HLE-Verified:得分 54.9%,展示在 STEM、人文與專業領域的多步推理能力。

專業領域代理評測:在 Vals Finance Agent V2 與 Harvey’s Legal Agent Benchmark 上超越 3.7 Flash 與其他尖端模型。

仍落後的項目:在 Terminal-bench 4.0 得分 19.1%(Claude Opus 5 為 51.8%);OSWorld 電腦操作評測為 59.0%(Opus 5 為 75.4%)。顯示在極長時間自主操作與桌面環境互動仍有進步空間。

2. Gemini 3.8 Flash Cyber

Flash Cyber 取代先前的 3.5 Flash Cyber,並將資源重點投放於漏洞修補(Auto-Patching):

自主漏洞探勘:在 CyberGym 與包含 20 種程式語言的內部評測中,成功率超過 70%。

自動修補(CWE-Bench):在 Collinear 營運的外部評測 CWE-Bench 上,pass@1 為 47.2%,接近領先旗艦模型的 47.8%。

實戰案例:Chrome 安全團隊表示其修復數量為大型商用模型的 2.6 倍;Wiz 滲透測試召回率高出 7.5 至 9.7 個百分點;Google Cloud 團隊曾藉此在兩小時內定位基礎架構關鍵漏洞。


CyberQ 本地獨立實測:Gemini 3.8 Flash 漏洞修補能力

針對官方公布的軟體代理與 CWE 漏洞修補表現,CyberQ 於 Linux (Ubuntu 24.04 / GCC 13.3 / Python 3.12) 環境下構建兩組典型 CWE 漏洞專案,實測 Gemini 3.8 Flash 在「無提示漏洞審查、錯誤定位、自動修補(Auto-Patching)與回歸測試」的完整表現。

實測一:C/C++ 記憶體安全(CWE-193 / CWE-787)

測試情境:網路封包解析器的結構體緩衝區(MAX_NAME_LEN 64)。

原始缺陷:邊界檢查寫為 name_len > MAX_NAME_LEN,當接收剛好 64 位元組輸入時,後續補上字串結束符 name[64] = '\0' 造成單一位元組越界寫入(Off-by-one Stack Buffer Overflow)。

修補前驗證:以 AddressSanitizer(-fsanitize=address)編譯執行,觸發邊界條件時程式立即被 ASan 崩潰攔截(WRITE of size 1 at stack-buffer-overflow)。

3.8 Flash 處置:

正確識別出 CWE-193 差一錯誤與 CWE-787 越界寫入。

精確定位根因為「未替 Null Terminator 預留長度」。

自動產出 Patch:將邊界條件修改為 if (name_len >= MAX_NAME_LEN) return -3;。

修補後驗證:重新透過 ASan 測試,正常封包解析無損,超長與邊界封包皆安全被拒,ASan 回報零錯誤。

實測二:Web 服務安全(CWE-22 路徑走訪與 CWE-78 指令注入)

測試情境:後端檔案儲存模組,提供檔案讀取與備份打包功能。

原始缺陷:

read_file 採用無效的 replace("../", ""),可輕易以 ....// 或絕對路徑脫離沙盒目錄(CWE-22)。

backup_data 使用 subprocess.run(f"tar ... {archive_name}", shell=True),傳入字串拼接導致指令注入(CWE-78)。

修補前驗證:Pytest 4 項驗證中有 3 項失敗(惡意路徑成功讀取外部密鑰,指令注入成功在目標路徑建立標記檔)。

3.8 Flash 處置:

將路徑處理全面重構為 pathlib.Path.resolve(),並使用 target_path.relative_to(base_dir) 進行強制沙盒約束。

移除 shell=True,改用清單引數(["tar", "-czf", ...])杜絕 Shell 語意解析注入。

修補後驗證:Pytest 4 項安全與功能測試 100% 全數通過(4 passed in 0.09s)。


Fairwind Program 與取得機制

Fairwind Program 是 Google 為 Flash Cyber 設立的審核發放管道,旨在防止具備強大漏洞挖掘能力的模型遭濫用。

優先審核對象:政府機關、關鍵基礎設施(CNI)營運者與開源軟體維護者。

申請入口:deepmind.google/fairwind-program。

首批夥伴:Palo Alto Networks、Snowflake、Wiz 與 Armadin。

台灣單位現況:目前官方文件未載明地區限制,但申請需經受信任防禦方審核流程。


CyberQ 觀點

綜合官方數據與 CyberQ 的第一手實測,我們提出三項關鍵觀察:

防禦方與攻擊方的模型發放分水嶺已成型:
從 Anthropic 的 Claude Mythos 5.1 到 Google 的 Fairwind Program,資安專用模型全面走向「僅限審核通過防禦方」的發放模式。對於一般企業與安全團隊,與其等待取得專用模型,不如善用通用版 3.8 Flash 建立結構化的安全修補代理流程,並透過整合了 Cyber 能力的第三方資安平台(如 Wiz、Palo Alto Networks)獲取進階的攻防效益。

通用版 3.8 Flash 已具備第一線防禦與修補實力:
在實際測試中,Gemini 3.8 Flash 不需要依賴未公開的 Cyber 版本,就已展現出成熟的軟體工程除錯與安全修補能力。對於企業內部的 Code Review、靜態分析後續修復、以及 CI/CD 安全管線整合,一般版 3.8 Flash 搭配合適的測試工具鏈(如 ASan、Pytest、靜態掃描器)已完全能勝任防禦任務。

成本效益為自動化代理的最大槓桿:
在長程軟體工程(DeepSWE 71.0%)與修補精度上,3.8 Flash 與旗艦模型(如 Claude Opus 5)僅有微幅差距,但價格差了 6 至 7 倍。這意味著企業可以以極低成本在 CI 流程中為每個 Pull Request 自動跑多輪「偵測-修復-編譯測試」迴圈,這是過去旗艦模型高昂成本難以普及的場景。

延伸閱讀

Google 官方部落格,Introducing Gemini 3.8 Flash and 3.8 Flash Cyber。https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/

Google DeepMind,Gemini 3.8 Flash 模型頁面。https://deepmind.google/models/gemini/flash/

Google DeepMind,Fairwind Program。https://deepmind.google/fairwind-program/

Collinear,CWE-Bench 排行榜。https://cwe-bench.com/#leaderboard

標籤: 3.8 Flash CyberGeminiGemini 3.8 Flash
Share9Tweet6ShareShareShare2
上一篇

實測 Claude Fable 5.1 與 Claude Mythos 5.1,快取讀取降價 75%

下一篇

Google 廣告帝國逃過拆分但遭重罰|Meta 語音轉錄低價搶市|產業精選 09.03

BabyQ

BabyQ

IT 工程師,專長是資訊系統管理、企業 AI Infra、雲端服務,協助客戶解決問題。 Switch 轉 Steam 新手用戶,夢想是看極光、大堡礁、冰山、熔岩等地球美景。

相關文章

新聞

Google 廣告帝國逃過拆分但遭重罰|Meta 語音轉錄低價搶市|產業精選 09.03

2026 年 9 月 3 日
實測 Claude Fable 5.1 與 Claude Mythos 5.1,快取讀取降價 75%
AI 人工智慧

實測 Claude Fable 5.1 與 Claude Mythos 5.1,快取讀取降價 75%

2026 年 9 月 2 日
馬斯克預估 AI 將帶來每年30兆美元全球經濟成長
AI 人工智慧

馬斯克預估 AI 將帶來每年30兆美元全球經濟成長

2026 年 9 月 2 日
尖端模型可透過「深思」喚回高達 65% 無法直接回憶的事實|產業精選 09.02
新聞

尖端模型可透過「深思」喚回高達 65% 無法直接回憶的事實|產業精選 09.02

2026 年 9 月 2 日
Apple 公開「震撼證據」指控前員工竊取資料給 OpenAI|產業精選 09.01
新聞

Apple 公開「震撼證據」指控前員工竊取資料給 OpenAI|產業精選 09.01

2026 年 9 月 1 日
OpenAI 領銜逾 200 家組織聯名警告 AI 網路攻擊即將擴散|AI 趨勢精選 08.31
AI 人工智慧

OpenAI 領銜逾 200 家組織聯名警告 AI 網路攻擊即將擴散|AI 趨勢精選 08.31

2026 年 8 月 31 日
下一篇

Google 廣告帝國逃過拆分但遭重罰|Meta 語音轉錄低價搶市|產業精選 09.03

推薦閱讀

Google 廣告帝國逃過拆分但遭重罰|Meta 語音轉錄低價搶市|產業精選 09.03

2026 年 9 月 3 日
實測新版 Gemini 3.8 Flash,資安專用模型3.8 Flash Cyber改採審核制發放

實測新版 Gemini 3.8 Flash,資安專用模型3.8 Flash Cyber改採審核制發放

2026 年 9 月 3 日
實測 Claude Fable 5.1 與 Claude Mythos 5.1,快取讀取降價 75%

實測 Claude Fable 5.1 與 Claude Mythos 5.1,快取讀取降價 75%

2026 年 9 月 2 日
馬斯克預估 AI 將帶來每年30兆美元全球經濟成長

馬斯克預估 AI 將帶來每年30兆美元全球經濟成長

2026 年 9 月 2 日
自架 Headscale 上的 Collie:把手機接到自架算力節點的 AI 代理人

自架 Headscale 上的 Collie:把手機接到自架算力節點的 AI 代理人

2026 年 9 月 2 日

近期熱門

  • GitHub 趨勢周報 Vol.30:技能包熱門,代理供應鏈掃描補上安全性

    GitHub 趨勢周報 Vol.30:技能包熱門,代理供應鏈掃描補上安全性

    170 shares
    Share 68 Tweet 43
  • 在 QNAP NAS 上打造地端 CI/CD:從 Git、Runner 到 Docker 自動部署

    117 shares
    Share 47 Tweet 29
  • 實測 Claude Fable 5.1 與 Claude Mythos 5.1,快取讀取降價 75%

    117 shares
    Share 47 Tweet 29
  • 採用 M6 與 M5 Pro 晶片的新款 Mac 登場,聚焦 AI 代理人與大模型部署潛力

    146 shares
    Share 58 Tweet 37
  • 桌面體驗全面解鎖,微軟釋出 Windows 11 選用預覽更新 KB5120998

    97 shares
    Share 39 Tweet 24
  • 用 Herdr 整合 Hermes Agent 地端與雲端 AI 代理人 於 QNAP NAS 架構上

    92 shares
    Share 37 Tweet 23
  • SONY華納聯手告 Anthropic 侵權|好萊塢轉戰微短劇|產業精選 08.30

    90 shares
    Share 36 Tweet 23
  • 自架 Headscale 上的 Collie:把手機接到自架算力節點的 AI 代理人

    86 shares
    Share 34 Tweet 22
  • 尖端模型可透過「深思」喚回高達 65% 無法直接回憶的事實|產業精選 09.02

    82 shares
    Share 33 Tweet 21
  • Anthropic 展示自我改進 AI 面貌|Meta 8B 小模型可接近 Opus 4.5|產業精選 08.29

    79 shares
    Share 32 Tweet 20

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。