CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

Qwen 3.8 開放權重可下載:Max 級 2.4T 模型首次開源,27B 亦值得期待

Chen Glenn by Chen Glenn
2026 年 08 月 12 日 23:53
in AI 人工智慧, 新聞
閱讀時間: 5 分鐘
A A
Qwen 3.8 開放權重可下載:Max 級 2.4T 模型首次開源,27B 亦值得期待
122
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

阿里巴巴 Qwen 團隊於日前發表 Qwen3.8 家族後,市場經過一週多的等待,開放權重終於在本週開放下載了,至於親民的 27B 版本會比較晚, Qwen 直接先把旗艦端上桌,Qwen3.8-2.4T-A95B 的完整權重與官方 FP8 量化版已同步上架 Hugging Face。

RELATED POSTS

Windows 11 更新 KB5121003 釋出,改善不少但須留意 Secure Boot 憑證換發地雷

Nvidia 開發參數破兆的 Nemotron 4 開源模型挑戰對手

FBI 警告私密影像勒索|Grok Bot 付費代理上線|產業精選 08.12

CyberQ 觀察,這可是 Qwen 系列首次將 Max 級模型開放釋出,在過去呢, Qwen3.7-Max 以前的所有 Max 級模型都是維持 API 專屬才能用,如今在 3.8 時代就正式開放權重給大家下載,可部署在企業級地端 AI 伺服器上。

📢Meet Qwen3.8-Max — our most capable model to date.

Next week, the open weights of Qwen3.8-Max will be released, and Qwen3.8-27B is also going open-weights to meet you all!🎉

Qwen3.8-Max, a new bar for coding and cowork at 2.4T parameters:

– Autonomous coding: 10+ days of… pic.twitter.com/e3YFj2hqcT

— Qwen (@Alibaba_Qwen) August 3, 2026

至於多數開發者真正等待的較小型模型 Qwen3.8-27B,官方確認仍會開放權重,但釋出時間延後,目前沒有明確日期。本文整理已上架的 2.4T 模型完整規格與基準數據、跑得動它需要什麼等級的硬體、社群量化生態的現況,以及它與 Kimi K3、DeepSeek V4 Flash 的三方格局。

已經先上架的內容兩個官方 repo

Hugging Face 的 Qwen 組織下目前有兩個 Qwen3.8 相關 repo:

Qwen/Qwen3.8-2.4T-A95B:BF16 完整權重,Safetensors 格式,相容 vLLM、SGLang 與 TokenSpeed。

Qwen/Qwen3.8-2.4T-A95B-FP8:官方 FP8 量化版,採 block size 128 的細粒度 FP8 量化,官方表示效能指標與原始模型幾乎相同。對中大型企業自組 AI 伺服器的用戶而言,這個版本直接把權重體積砍半,是實務上的首選起點。

兩個 repo 的授權均標示為自訂的「qwen3.8-max」授權,並非 Apache 2.0。條款細節請務必在部署前詳讀 repo 內的 LICENSE 檔案。

一個容易踩雷的重點是開放權重版不等於 API 上的 Qwen3.8-Max。該公司釋出的模型卡明確說明,開放的 Qwen3.8-2.4T-A95B 是純文字模型,且強制啟用思考模式,無法關閉,每個回應都會先輸出 <think> 推理內容。API 上的 Qwen3.8-Max 則是以此為基礎的加值版本,額外提供視覺輸入、非思考模式、預設 1M 上下文與官方內建工具。所以呢,千問的多模態能力並沒有隨權重開放,因此,需要視覺輸入的用戶仍然只能乖乖付費用官方 API。

Qwen3.5 血統的混合注意力 MoE 架構解密

阿里巴巴這次公布的模型卡,首次完整公開這一代旗艦架構,有幾個值得注意的設計:

項目規格
總參數 / 活躍參數2.4T / 95B
層數92 層
隱藏維度8192
層布局23 × (3 × (Gated DeltaNet → MoE) → 1 × (Gated Attention → MoE))
專家配置512 個專家,每 token 啟用 10 路由 + 1 共享
專家中間維度2048
MTP多步訓練的多 token 預測頭
原生上下文262,144 token,可延伸至 1,010,000

架構建立在 Qwen3.5 的基礎上,最大特徵是線性注意力與標準注意力的混合布局,每 4 層中有 3 層採用 Gated DeltaNet 線性注意力,僅 1 層保留 Gated Attention 標準注意力。這種 3:1 的比例設定,大幅壓低了長上下文的 KV cache 成本,是它能撐到百萬 token 上下文的關鍵。MTP 投機小模型經過多步訓練,意味著推測解碼加速在官方層面就有支援基礎。

強制思考模式搭配 reasoning_effort 參數(xhigh、medium、low 三檔)與 preserve_thinking(保留歷史訊息的推理脈絡),顯示這一代的定位完全朝長程代理任務傾斜。官方建議取樣參數為 temperature=1.0、top_p=0.95、top_k=20,代理任務建議推理內容上限拉到 262,144 token、最終回應 131,072 token。

官方自己公布的成績顯示開放權重首次貼近閉源前段班 !

官方公布的基準將 Qwen3.8-Max 與 Claude Opus 4.8、Claude Fable 5、GPT 5.6 Sol 並列,重點數字如下(廠商自測,評測環境詳見模型卡註記):

基準Opus 4.8Fable 5GPT 5.6 SolQwen3.8-Max
Terminal Bench 2.184.684.688.886.6
SWE-bench Pro69.280.064.667.7
PaperBench80.388.890.593.0
AndroidBench69.884.574.075.1
CoWorkBench72.375.971.574.8
GPQA Diamond92.092.694.192.6
IFBench62.263.572.782.8
HealthBench52.4—55.360.2
MRCR v2 256K83.2—93.892.9

CyberQ 提醒,判讀這次官方公布的資料時要留意三點。第一,這是廠商自測數據,且大量使用 Claude Code 作為評測 harness,各家評測條件不完全對齊。

第二,Qwen3.8-Max 在 PaperBench、IFBench、HealthBench 等項目領先所有閉源對手,在 Terminal Bench 與長上下文檢索(MRCR)貼近第一名,但在 SWE-bench Pro 與 DeepSWE 等硬核軟體工程項目仍與 Fable 5 有明顯差距。

第三,相較前代 Qwen3.7-Max 的進步幅度非常大,DeepSWE 從 21.6 跳到 56.6,FrontierSWE 從 40.7 跳到 73.5,這種顯著的變化,是目前社群關注的焦點。

無論如何,一個基準上能與 Opus 4.8 和 GPT 5.6 Sol 同桌的模型,現在權重就放在 Hugging Face 上任人下載,這件事對產業來說,就是個重要的里程碑。

需要怎樣的機器才跑得動

2.4T 參數的權重記憶體需求非常之高:

精度權重記憶體硬體等級
BF16約 4.8TB多節點 GPU 叢集(如 8 節點 × 8 × H200 141GB)
FP8(官方版)約 2.4TB單節點放不下,仍需多節點或 NVL72 級機櫃

即使每 token 只啟用 95B 參數,MoE 的本質是全部 2.4T 權重都必須常駐在加速器可及的記憶體中。而 KV cache 拜混合注意力架構之賜雖然相對可節省一些記憶體,但在這種超大記憶體規模用量的情況下不是重點了。這款模型的首要服務對象,是給雲端供應商、大型企業與研究機構自架的模型,不是個人開發者或小型公司能負擔得起的。開發者熱門的 DGX Spark 的 128GB 統一記憶體連權重的零頭都放不下,Mac 平台的話要更多記憶體也才能載得下,而本站測試平台這次只能先透過 API 體驗。

這也正是 27B 市場期待它開放下載的原因。以 27B 級模型推算,BF16 約 54GB、FP8 約 27GB、4-bit 量化約 14 至 16GB(不含 KV cache),Unsloth 先前預告量化版約 17GB 記憶體可跑。一張 24GB 消費卡就能承載的先進規格模型,才是真正能改變地端 AI 部署格局的重點產品。阿里巴巴官方有確認 27B 仍在路上,只是要再等一段時間。

社群量化現況自然是 2.4T 太大,火力全部留給 27B

權重上架後的社群反應呈現有趣的分化。

2.4T 版本這邊,量化的意義有限。官方已提供 FP8,再往下壓到 4-bit 也還有 1.2TB 上下,脫離消費級與工作站硬體的範圍,因此 GGUF 社群對它興趣缺缺,目前 Hugging Face 上僅有零星衍生量化。推論引擎支援則是率先支援,對雲端業者與大型公司來說很需要,vLLM 與 SGLang 均已發布 Qwen3.8 的官方部署 recipe 與 cookbook,多節點部署是有彈性的。

27B 這邊則是萬事俱備只欠權重。量化作者 huginnfork 先前預先註冊的 FP8 與 NVFP4A16 佔位 repo 仍在待命,公開的量化配方(僅量化 MLP 層,注意力區塊與 MTP 頭保留 bf16,NVFP4 採 W4A16)沿用自 Qwen3.6-27B 家族的成熟作法。Unsloth 依慣例會在權重上架後數小時內出貨 Dynamic GGUF,CyberQ 指出,若以 Qwen3.6 部署經驗來看,預估 Q4_K_M 是甜蜜點,MTP GGUF 搭配 llama.cpp 的推測解碼支援可再帶來約 1.4 至 2 倍加速。2.4T 版本確認保留多步訓練的 MTP 投機模型,若 27B 同樣保留,這條加速路徑可望直接沿用。

授權屬於自訂條款,商用前必讀

兩個官方 repo 的授權欄位均標示「qwen3.8-max」,是為這一代量身打造的自訂授權,而非 Apache 2.0。這延續了 Qwen 在旗艦級模型上的一貫作法(前例是內含一億月活躍用戶門檻的通義千問授權)。發表初期社群曾流傳條款疑似對特定地區設限的說法,在官方授權全文面前,這類二手轉述都應以 repo 內的 LICENSE 檔案為準。對台灣的企業用戶而言,導入評估時除了技術驗證,法務端的授權審閱這次是必要程序,特別是打算以此模型提供對外服務的公司,授權部分要留意。

三強對照:開放權重的天花板之爭改寫了

Qwen3.8 權重落地後,2026 年下半年的 AI 模型開放權重頂級版本就有新局面囉:

項目Qwen3.8-2.4T-A95BKimi K3DeepSeek V4 Flash 0731
開發商阿里巴巴 QwenMoonshot AI 月之暗面DeepSeek 深度求索
權重釋出2026/8 中旬2026/7/272026/7/31
總參數2.4T(MoE,512 專家選 10+1)2.8T(MoE,896 專家選 16)284B(MoE)
活躍參數95B104B13B
注意力架構Gated DeltaNet + Gated Attention 混合(3:1)Kimi Delta Attention + Stable LatentMoE標準 MoE
上下文原生 262K,可延伸至 1.01M1M1M
模態(開放版)純文字原生視覺純文字
思考模式強制啟用,三檔 reasoning_effort支援 max thinking低中高三檔 effort
API 定價(輸入/輸出,每百萬 token)$2 / $6約 $2.31 混合約 $0.08 至 $0.15 起
授權自訂 qwen3.8-max 授權自訂 Kimi K3 授權(MaaS 營收逾 2000 萬美元須另議)相對寬鬆(V4 Pro 為 MIT)

三者的定位在權重落地後更加清晰。Kimi K3 仍是獨立評測的智慧榜首(Artificial Analysis 指數約 57 至 60),且是三者中唯一具備原生視覺的開放模型。DeepSeek V4 Flash 以 13B 活躍參數與地板級定價(快取命中低至每百萬 token 0.0028 美元)守住成本效率的位置。Qwen3.8 則帶來三者中最完整的閉源對標數據,是第一個敢在模型卡上直接列出與 Opus 4.8、Fable 5、GPT 5.6 Sol 逐項對決的開放模型,並以混合注意力架構在長上下文效率上另闢蹊徑。

值得玩味的是各家基準測試依然互不列入彼此,Qwen 的對照表只放閉源模型,Moonshot 與 DeepSeek 的圖表也互相缺席。開放權重陣營內部的直接對決,要等獨立評測機構補上。

產業影響:Max 級開源改變了什麼

CyberQ 觀察,開放權重模型的天花板真的是變化很快,六週內,Moonshot 開放 2.8T 的 K3,阿里開放 2.4T 的 Qwen3.8,兆級參數旗艦開源從特例變成常態。中國實驗室之間的競爭大概是這樣,閉源模型留給加值服務(視覺、內建工具、託管推論),而基礎模型本體則改成全面開放換取開發者生態與市場話語權。Qwen 模型卡上寫出「首次將 Max 級模型開放釋出」的宣示,等於直接回應了 K3 開源的壓力。

雲端推論供應商成為最大受益者。 2.4T 模型的自架門檻是多節點叢集,絕大多數用戶跑不動,但第三方推論業者都跑得動。開放權重讓 Baseten、Together 這類供應商得以在阿里官方 API 之外提供替代服務,價格競爭與資料主權選項(例如針對需要非中國市場 AI 算力的用戶)也跟著出現。對受 ITGC 或資安規範約束的企業,「同一個模型、不同司法管轄區的供應商」成為市場上可行的採購選項。

本地部署的希望仍寄託在 27B,儘管 2.4T 的開源在戰略上震撼,但是在個人與中小企業的實務上無感。真正能進入工作站、NAS 推論平台與 homelab 的是 27B。若它繼承這一代的後訓練成果與 MTP 加速路徑,將是 2026 年本地 AI 最重要的一次釋出。

台灣市場可關注這個模型的發展,絕對是要注意的,對本地 MSP 與系統整合商 SI 而言,短期的實務建議是,需要 Qwen3.8 能力的專案先以 API 或第三方託管驗證效益,同時將授權審閱納入評估流程,等 27B 落地後再評估地端方案。混合注意力架構對推論框架版本的要求較高,自架時務必使用 vLLM 與 SGLang 的最新版本與官方 recipe。

CyberQ 觀點

這次 Qwen3.8 的權重落地方式是先開放跑不動的旗艦,讓比較多人跑得動的 27B 晚一點發,這個順序本身就是訊息。旗艦開源承擔的是基準話語權與生態卡位,27B 承擔的才是實際採用,Qwen 基於市場考量,選擇先拿話語權。

CyberQ 將持續追蹤 27B 的釋出動態,權重落地後在 DGX Spark 與消費級 GPU 、Mac 等平台上進行實測,包含 vLLM FP8 部署、GGUF 量化品質對比與 MTP 推測解碼加速實測,敬請期待。

阿里巴巴Qwen3.8-Max登場 2.4兆參數權重即將開放
Nvidia 開發參數破兆的 Nemotron 4 開源模型挑戰對手
DGX Spark 實戰 Muse-Glimmer-30B:NVFP4 + DFlash 讓本地 AI Agent 速度提升 6 倍
DGX Spark + NAS 實測 Muse-Glimmer-30B 跑 AIME 2026 對照 Meta 官方數字
ComfyUI 0.31.0 盡收主流地端影像模型,DGX Spark + QNAP NAS 的實戰架構
標籤: QwenQwen3.8Qwen3.8-27B地端AI開放模型開放權重
Share2Tweet1ShareShareShare
上一篇

Windows 11 更新 KB5121003 釋出,改善不少但須留意 Secure Boot 憑證換發地雷

Chen Glenn

Chen Glenn

開發工程師,目前在北台灣的科技業任職。

相關文章

Windows 11 更新 KB5121003 釋出,改善不少但須留意 Secure Boot 憑證換發地雷
新聞

Windows 11 更新 KB5121003 釋出,改善不少但須留意 Secure Boot 憑證換發地雷

2026 年 8 月 12 日
Nvidia 開發參數破兆的 Nemotron 4 開源模型挑戰對手
AI 人工智慧

Nvidia 開發參數破兆的 Nemotron 4 開源模型挑戰對手

2026 年 8 月 12 日
新聞

FBI 警告私密影像勒索|Grok Bot 付費代理上線|產業精選 08.12

2026 年 8 月 12 日
新聞

Bluesky活躍用戶衰退|OpenAI共同營運長出走|River AI獲11億美元融資|產業精選 08.11

2026 年 8 月 11 日
Meta 開源 Muse Glimmer 30B 將本地 AI Agent 進入「單卡可跑」時代 ?
AI 人工智慧

Meta 開源 Muse Glimmer 30B 將本地 AI Agent 進入「單卡可跑」時代 ?

2026 年 8 月 10 日
Claude Code Auto Mode 下週起預設開啟|Meta 推 Muse Code|產業精選 08.10產業精選 08.10
AI 人工智慧

Claude Code Auto Mode 下週起預設開啟|Meta 推 Muse Code|產業精選 08.10產業精選 08.10

2026 年 8 月 10 日

推薦閱讀

Qwen 3.8 開放權重可下載:Max 級 2.4T 模型首次開源,27B 亦值得期待

Qwen 3.8 開放權重可下載:Max 級 2.4T 模型首次開源,27B 亦值得期待

2026 年 8 月 12 日
Windows 11 更新 KB5121003 釋出,改善不少但須留意 Secure Boot 憑證換發地雷

Windows 11 更新 KB5121003 釋出,改善不少但須留意 Secure Boot 憑證換發地雷

2026 年 8 月 12 日
Nvidia 開發參數破兆的 Nemotron 4 開源模型挑戰對手

Nvidia 開發參數破兆的 Nemotron 4 開源模型挑戰對手

2026 年 8 月 12 日
DGX Spark 實戰 Muse-Glimmer-30B:NVFP4 + DFlash 讓本地 AI Agent 速度提升 6 倍

DGX Spark 實戰 Muse-Glimmer-30B:NVFP4 + DFlash 讓本地 AI Agent 速度提升 6 倍

2026 年 8 月 12 日

FBI 警告私密影像勒索|Grok Bot 付費代理上線|產業精選 08.12

2026 年 8 月 12 日

近期熱門

  • AI 親密機器人被看好,成人市場可能成為家用人型機器人率先落地的入口

    AI 親密機器人被看好,成人市場可能成為家用人型機器人率先落地的入口

    1375 shares
    Share 550 Tweet 344
  • ComfyUI 0.31.0 盡收主流地端影像模型,DGX Spark + QNAP NAS 的實戰架構

    150 shares
    Share 60 Tweet 38
  • GitHub 趨勢周報 Vol.27:兆級參數落地消費級硬體,AI 資安研究工具走向產品化

    134 shares
    Share 54 Tweet 34
  • DGX Spark + NAS 實測 Muse-Glimmer-30B 跑 AIME 2026 對照 Meta 官方數字

    133 shares
    Share 53 Tweet 33
  • PVE 與 QNAP NAS 打造企業級虛擬化架構 + ZFS、iSCSI 與 HA 高可用性

    119 shares
    Share 48 Tweet 30
  • Meta 開源 Muse Glimmer 30B 將本地 AI Agent 進入「單卡可跑」時代 ?

    119 shares
    Share 48 Tweet 30
  • OpenAI Astra 觸及最高網路風險等級暫緩開發|Google DeepMind 世代交棒 Hassabis 退居幕後|AI 趨勢週報

    98 shares
    Share 39 Tweet 25
  • DGX Spark 跑通 MiniMax-H3 官方全權重實測,搭配 QNAP NAS 載入與輸出

    321 shares
    Share 128 Tweet 80
  • 記憶體成本狂飆!AI算力排擠效應引起的軟體瘦身革命

    154 shares
    Share 62 Tweet 39
  • Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

    207 shares
    Share 83 Tweet 52

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。