CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片

Ashley Hsieh by Ashley Hsieh
2026 年 08 月 05 日 16:04
in AI 人工智慧, 新聞
閱讀時間: 2 分鐘
A A
Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片
1.7k
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

法國人工智慧公司 Mistral AI 近日推出一款大小約3B參數的開放權重多模態安全分類模型 Shieldstral,它可以檢查文字、圖片,以及文字搭配圖片的內容,協助開發人員判斷使用者輸入或模型輸出是否符合預先設定的安全政策。而且Shieldstral並沒有被限制在只能搭配 Mistral旗下的模型,而是能作為獨立的內容安全分類器部署在不同大型語言模型或多模態模型的前後端,檢查模型接收與產生的內容。

RELATED POSTS

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

SpaceX首場財報馬斯克狂加碼承諾|AI代理燒錢與測量難題浮現|產業精選 08.05

以自然語言設定內容安全政策

傳統內容防護模型通常會在訓練階段就預先設定仇恨言論、暴力、色情或危險行為等有害內容類別。但是當產品用途、使用族群或審核標準改變時,原本的分類方式可能就不一定合適,開發團隊就會需要花費許多資源來重新微調模型或增加其他判斷規則。而Shieldstral 將內容審核轉化為二元問答任務,開發人員可以在模型執行時,以自然語言提出要檢查的問題,例如「這張圖片是否適合未成年人觀看?」或「這段內容是否鼓勵針對特定族群的暴力行為?」

每次送交 Shieldstral 的內容可分為 Instruct、Query與Document 三部分。Instruct 說明說明審核情境、嚴格程度,以及必要時定義何謂不安全內容,Query 提出可以回答「是」或「否」的政策問題,Document 則是實際要檢查的使用者提示、模型回答、提示與回答的組合,或附帶文字的圖片。Shieldstral會根據「是」與「否」的輸出機率來產生連續性的安全評分,開發人員可以依照產品需求設定判定門檻,例如採取較嚴格的標準攔截兒童平台內容,或為專業資安研究工具保留較大的討論空間,這套架構讓開發人員可以直接修改自然語言問題,不必因此重新訓練整個模型。

但是這不代表 Shieldstral 內建預先整理好的法規資料庫,它也不會自動替企業建立符合歐盟或特定產業法規的完整規則,企業必須自行決定要檢查哪些條件,並以明確的自然語言定義政策。

單一模型整合文字與圖片審核

Mistral表示,Shieldstral在文字安全、拒絕回答偵測、政策適應能力及多模態安全等評測中,可媲美或超越參數規模接近其七倍的部分開放權重護欄模型。Shieldstral可在單張16GB顯示記憶體的 NVIDIA GPU上執行,這點也讓想自行部署內容安全分類模型的企業不在遙不可及,但實際執行起來的速度及硬體需求,仍會受到輸入長度、量化方式、推論框架及同時處理的請求數量影響。Mistral已依照 Apache 2.0授權釋出 Shieldstral模型權重,開發人員可以自行下載及部署。

Mistral Shieldstral與Google ShieldGemma有何不同

其實早在 Shieldstral 推出以前,Google 便已發布 ShieldGemma系列安全分類模型。兩者都能檢查使用者輸入或模型產出的內容是否違反安全政策,但在模型設計及支援內容方面有所差異。

Google ShieldGemma 將文字與圖片審核交給不同版本處理。第一代 ShieldGemma建立在 Gemma 2之上,提供2B、9B及27B三種規模,主要檢查英文文字是否涉及色情、危險內容、仇恨及騷擾。ShieldGemma 2則建立在 Gemma 3之上,是一款4B圖片安全分類模型,主要檢查色情、危險內容,以及暴力血腥圖片。

Shieldstral 則是以單一模型來處理文字、圖片及文字搭配圖片的內容,並將政策適應能力列為主要設計重點,讓開發人員可以在模型執行時更換自然語言問題,讓同一個模型依照不同產品、使用者及情境採用不同的判斷標準。

比較項目Mistral ShieldstralGoogle ShieldGemma
開發公司Mistral AIGoogle
模型規模3B級ShieldGemma 1提供2B、9B及27B;ShieldGemma 2為4B
審核內容單一模型處理文字、圖片及文字搭配圖片ShieldGemma 1處理文字;ShieldGemma 2處理圖片
政策設定執行時以自然語言問題設定,強調適應新政策輸入內容中也可提供安全政策,但主要針對預先訓練的重點危害類別
主要功能提示分類、回答審核、提示與回答組合判斷、拒絕回答偵測及多模態審核ShieldGemma 1檢查文字輸入與輸出;ShieldGemma 2檢查自然或生成圖片
判斷結果根據「是/否」機率產生連續評分ShieldGemma 1輸出「是/否」;ShieldGemma 2提供「是/否」機率
開放方式開放權重,採 Apache 2.0授權開放權重,使用時須遵守 Google的 Gemma使用條款

雖然 Google 的 ShieldGemma 同樣允許開發人員在輸入內容中加入安全政策,但 ShieldGemma 主要針對色情、危險內容、仇恨、騷擾及暴力等特定危害類別進行訓練,判斷結果容易受到安全政策文字描述方式影響,當語意模糊或需要理解細微差異的情況下,表現可能不穩定。而 Mistral Shieldstral的設計重點,則是讓模型能夠理解不同安全規則之間的細微差異,並在不重新訓練的情況下,依照新設定的規則審查內容。無論企業是導入 Shieldstral或 ShieldGemma,仍須自行測試政策文字、判定門檻,以及可能發生的誤判與漏判。

CyberQ觀點

Shieldstral 值得關注的地方,除了模型規模小容易部署,更重要的是它把企業的內容規範變成可以隨時調整的審核條件。這雖然提高了使用上的彈性,這也意味著將更多責任交給使用的企業本身。政策問題寫得是否明確、判定門檻是否合理,都會直接影響結果;如果一開始就將規範訂的過於模糊,Shieldstral便會將這套模糊標準自動化。

因此 企業導入 Shieldstral 的主要需要關注的點未必是GPU跑不跑得動,而是建立測試資料、調整攔截門檻,以及決定誤判後由誰來處理。例如醫療平台若設定過嚴,可能攔截正常的疾病討論;資安平台若設定過寬,又可能放行真正具有攻擊風險的內容,這些判斷無法只靠模型的安全評分就完成。

而且也不能用Shieldstral 來取代主要人工智慧模型原有的安全措施,更不能用來證明企業已符合法規,Shieldstral 比較適合放在模型前後,作為可以依照產品需求調整的額外檢查層。未來這類產品能否真正進入企業環境,關鍵不只在評測分數,而是企業能否把內部規範轉換成清楚、可測試且能持續更新的審核條件。

首圖由 Nano Banana AI 生成

Mistral 發表 Medium 3.5 旗艦模型並推出 Vibe 遠端代理系統
Mistral 推出開源語音生成模型 Voxtral 提升文字轉語音自然度
Mistral Forge 打造企業專屬頂級 AI,同場加映 Mistral Small 4 與駐點科學家
ASML 為何豪擲千金投資法國 AI 新星 Mistral AI?
標籤: AI治理Mistral AIShieldstral內容審核多模態安全
Share20Tweet13ShareShareShare4
上一篇

SpaceX首場財報馬斯克狂加碼承諾|AI代理燒錢與測量難題浮現|產業精選 08.05

下一篇

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

Ashley Hsieh

Ashley Hsieh

專案管理者與 UI/UX 設計、AI美術設計認證、淨零碳規劃管理師,在上市歐洲外商、生醫、金融、科技產業中淬煉,曾參與過多個跨平台專案,從需求分析、設計、使用者測試到專案交付流程都樂在其中。 私底下,我是一位「喜歡買東西但錢包容易抗議」的人,對科技、設計與藝術有熱情,正在努力平衡質感生活,學習和錢包一起成長的日常小練習者。

相關文章

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼
AI 人工智慧

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

2026 年 8 月 5 日
Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent
AI 人工智慧

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

2026 年 8 月 5 日
新聞

SpaceX首場財報馬斯克狂加碼承諾|AI代理燒錢與測量難題浮現|產業精選 08.05

2026 年 8 月 5 日
DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出
AI 人工智慧

DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出

2026 年 8 月 5 日
MiniMax H3開放權重影片模型登場 支援多模態素材與原生立體聲
AI 人工智慧

MiniMax H3開放權重影片模型登場 支援多模態素材與原生立體聲

2026 年 8 月 4 日
AI 浪潮襲來,企業能記取歷史教訓,成功重塑勞工技能嗎?
AI 人工智慧

AI 浪潮襲來,企業能記取歷史教訓,成功重塑勞工技能嗎?

2026 年 8 月 4 日
下一篇
Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

推薦閱讀

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

2026 年 8 月 5 日
Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

2026 年 8 月 5 日
Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片

Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片

2026 年 8 月 5 日

SpaceX首場財報馬斯克狂加碼承諾|AI代理燒錢與測量難題浮現|產業精選 08.05

2026 年 8 月 5 日
DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出

DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出

2026 年 8 月 5 日

近期熱門

  • DeepSeek V4 Flash 正式版成績不俗且成本僅 Gemini 的 1/19,開放權重挑戰閉源 AI

    DeepSeek V4 Flash 正式版成績不俗且成本僅 Gemini 的 1/19,開放權重挑戰閉源 AI

    282 shares
    Share 113 Tweet 71
  • DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出

    202 shares
    Share 81 Tweet 51
  • QNAP AI NAS Edge AI 方案與自建 DGX Spark 地端 LLM 架構比較

    153 shares
    Share 61 Tweet 38
  • MiniMax H3開放權重影片模型登場 支援多模態素材與原生立體聲

    120 shares
    Share 48 Tweet 30
  • 全球記憶體短缺衝擊 MacBook Air|GraphRAG與向量RAG的適用情境比較|產業精選 08.03

    119 shares
    Share 48 Tweet 30
  • Apple Upgrade 計畫改寫持有模式 | 知名 YouTuber 坦言 AI 讓人出現多巴胺依賴

    107 shares
    Share 43 Tweet 27
  • GitHub 趨勢周報 Vol.26:AI 教育普及與開源工具創新的雙重浪潮

    95 shares
    Share 38 Tweet 24
  • AI 浪潮襲來,企業能記取歷史教訓,成功重塑勞工技能嗎?

    92 shares
    Share 37 Tweet 23
  • FCC 擴大設備禁令海外先進機器人與電源逆變器入列

    90 shares
    Share 36 Tweet 23
  • Qwen3.8-Max 宣稱代理式電腦使用超越 GPT-5.6 與 Fable 5|Palantir 稱先進 AI 實驗室不可信|產業精選 08.04

    88 shares
    Share 35 Tweet 22

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。