CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

Qwen3.8-Flash-Next 開放權重 提前展示 Qwen4 超稀疏架構

Ashley Hsieh by Ashley Hsieh
2026 年 08 月 27 日 08:00
in AI 人工智慧, 新聞
閱讀時間: 3 分鐘
A A
Qwen3.8-Flash-Next 開放權重 提前展示 Qwen4 超稀疏架構
4.6k
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

阿里巴巴旗下 Qwen 團隊近日發布了最新的 Qwen3.8-Flash-Next 模型。這款模型採用的是 Qwen4 預計採用的實驗性預覽版架構,是一款多模態超稀疏混合專家模型,能夠用較少的啟用參數降低運算成本。

RELATED POSTS

AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

黃仁勳籲 AI 監管放手讓業者自理|費城抗議資料中心擴建|AI墳場揭失敗清單|產業精選 09.16

從零打造自己的 Linux:Linux from Scratch

超稀疏混合專家模型與 N-gram Embedding

這款模型最值得關注的地方在於其採用的超稀疏混合專家模型架構,模型主體具有125B參數,但每個 token 只會啟用其中6B參數,另外還包含51B N-gram Embedding 與 4B MTP 參數,相較於 Qwen3.8-27B密集型模型每 token 就需要啟用27B參數,新架構有效減少了每個 token 所需的主要模型運算量。

這款模型還有一個特殊設計是51B N-gram Embedding,它是以由2至3個 token 組成的短序列索引嵌入表,藉由少量額外運算擴大模型容量。這組 N-gram Embedding可卸載至主機記憶體,並透過非同步預取與GPU計算重疊來減輕加速器記憶體的壓力及部分資料傳輸延遲的問題。

整體模型架構圖 Photo Credit by https://qwen.ai/

原生支援超長上下文與高效訓練

這款模型在處理長篇內容方面,改為使用 Gated DeltaNet(GDN)與Qwen Sparse Attention(QSA)的混合架構。GDN負責壓縮歷史資訊,QSA則以微型區塊為單位選取重要內容,以此來降低長上下文的注意力運算成本。這項設計讓模型原生支援262,144 token,並可透過YaRN等RoPE縮放技術延伸至100萬 token,適合用來處理大量技術文件、程式碼或會議紀錄。但是當延伸至100萬 token 後的實際效能,仍會受到推論框架、硬體配置及相關設定影響。

模型採用 Gated Residual,將負責在各模型層之間保留及傳遞資訊的通道擴展為四個分支,再透過動態閘門控制各分支讀取與寫入資訊的方式,訓練時則依不同權重類型搭配Muon與AdamW最佳化器。

官方表示,與Qwen3.7-Plus相比,Qwen3.8-Flash-Next的訓練成本約為九分之一,推論成本也大幅降低,同時改善訓練穩定性。這代表新架構不只著重降低模型運作時的成本,也試圖從訓練階段提高整體效率。

聚焦 AI 代理人與高吞吐應用

根據 Qwen 在Hugging Face公布的官方模型介紹與規格資料,Qwen3.8-Flash-Next的評測重點涵蓋代理式程式開發、長時間辦公任務、專業工作與工具使用。從官方公開的測試項目來看,這款模型的重點不只在一般對話,更在於需要長上下文、程式開發及反覆使用工具的AI代理人工作。

搭配Qwen Code或其他具備檔案與工具權限的代理框架後,這款模型可用於讀取大型程式庫、修改多個檔案與除錯。官方以Claude Code框架進行SWE-bench Pro測試時,Qwen3.8-Flash-Next獲得62.5分,略高於Qwen3.8-27B的61.7分。

Qwen官方公布的純文字評測結果,涵蓋程式開發、AI代理人、工具使用與一般推理能力。Photo Credit by https://qwen.ai/

在商務環境中,模型也可透過代理系統連接API、資料庫或檔案系統,執行複雜的多步驟工作。其長上下文能力也適合協助處理大量合約、內部文件或會議紀錄,但實際使用時仍須驗證資料擷取與分析結果。模型本身並不會自動取得這些系統的存取權,企業仍須自行設定代理框架、工具及權限。

Qwen3.8-Flash-Next 具備視覺編碼器,能夠理解圖片、影片與操作畫面。搭配電腦操作型代理框架後,可以根據畫面內容判斷下一步操作,朝向能理解畫面並使用工具的AI代理人發展。

多模態評測 Photo Credit by https://qwen.ai/

對需要處理大量推論請求的服務而言,每個 token 僅啟用6B參數,確實能減少主要模型的運算量,但是實際延遲與成本仍會受到硬體、推論框架、權重卸載方式、同時處理的請求數量及上下文長度影響,不能只根據啟用參數量來判斷。

企業也可以將模型部署於封閉環境,處理內部程式碼與文件。不過,Qwen3.8-Flash-Next 採用 Qwen Community License 1.0,依照授權條款,若模型僅供公司內部使用,且不向第三方提供模型、輸出結果或底層能力,不會受到另外取得授權的條款限制;但是若要對外提供模型服務,或經營以程式開發、辦公生產力為主的商業AI助理,就必須先向 Qwen 另外取得授權。

本地部署仍需大量記憶體

雖然模型主打每個 token 僅啟用6B參數,但官方模型卡列出125B主模型參數、51B N-gram Embedding與4B MTP參數,完整模型規模為180B,目前釋出的BF16權重檔約為360GB。6B只代表每個 token 參與主要運算的參數量,並不表示只需要載入6B權重。本地部署時仍須透過GPU記憶體、主機記憶體或儲存裝置,容納完整或量化後的必要權重,雖然 N-gram Embedding 與部分模型權重可以卸載至主機記憶體,但整體記憶體需求仍遠遠高於7B模型,實際所需硬體則會因量化格式、推論框架與權重卸載方式而有所不同。

CyberQ觀點

Qwen3.8-Flash-Next 的設計並不是單純縮小模型,而是將模型具有的總容量與每次實際使用的運算量分開處理,走的是重視效率的模型擴充路線,透過超稀疏混合專家架構、稀疏注意力、Gated Residual與可卸載的N-gram Embedding,在擴大模型容量的同時控制每個 token 的運算量。

官方測試顯示,這套架構適合被運用在代理式程式開發、辦公任務與工具使用,但是實際成本效益仍取決於硬體、推論框架、上下文長度與代理系統的整合方式,而且企業也必須將權限管理、資料安全及模型輸出驗證等因素一併納入考量。

由 於Qwen3.8-Flash-Next是Qwen4架構的實驗性預覽版本,相關技術後續如何應用於正式的Qwen4模型也值得大家持續關注。至於這套架構是否會成為自動化開發與公司AI代理系統的重要基礎,仍有待正式模型發布及更多的實際部署來驗證。

本文首圖由 AI 生成

390 次 Agent Harness 實測 dsw vs Qwen Code:DFlash2 投機解碼與雙機平行推論的工程真相
實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?
Qwen 3.8 開放權重可下載:Max 級 2.4T 模型首次開源,27B 亦值得期待
阿里巴巴Qwen3.8-Max登場 2.4兆參數權重即將開放
標籤: GDN與QSA架構N-gram EmbeddingQwen3.8-Flash-NextQwen4架構預覽超稀疏MoE
Share55Tweet34ShareShareShare10
上一篇

NVIDIA 洽購開源 AI 平台 Hugging Face 估值逾 130 億美元|產業精選 08.27

下一篇

QuTS hero h6.0.2.3591 更新實測,改善 ZFS 高負載效能

Ashley Hsieh

Ashley Hsieh

專案管理者與 UI/UX 設計、AI美術設計認證、淨零碳規劃管理師,在上市歐洲外商、生醫、金融、科技產業中淬煉,曾參與過多個跨平台專案,從需求分析、設計、使用者測試到專案交付流程都樂在其中。 私底下,我是一位「喜歡買東西但錢包容易抗議」的人,對科技、設計與藝術有熱情,正在努力平衡質感生活,學習和錢包一起成長的日常小練習者。

相關文章

AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎
AI 人工智慧

AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

2026 年 9 月 16 日
黃仁勳籲 AI 監管放手讓業者自理|費城抗議資料中心擴建|AI墳場揭失敗清單|產業精選 09.16
新聞

黃仁勳籲 AI 監管放手讓業者自理|費城抗議資料中心擴建|AI墳場揭失敗清單|產業精選 09.16

2026 年 9 月 16 日
新聞

從零打造自己的 Linux:Linux from Scratch

2026 年 9 月 16 日
商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域
新聞

商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域

2026 年 9 月 15 日
微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決
新聞

微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決

2026 年 9 月 15 日
Steam Frame 售價 1059 美元起跳,Valve 跨足硬體市場再掀波瀾
新聞

Steam Frame 售價 1059 美元起跳,Valve 跨足硬體市場再掀波瀾

2026 年 9 月 15 日
下一篇
QuTS hero h6.0.2.3591 更新實測,改善 ZFS 高負載效能

QuTS hero h6.0.2.3591 更新實測,改善 ZFS 高負載效能

桌面體驗全面解鎖,微軟釋出 Windows 11 選用預覽更新 KB5120998

桌面體驗全面解鎖,微軟釋出 Windows 11 選用預覽更新 KB5120998

GitHub 趨勢周報 Vol.30:技能包熱門,代理供應鏈掃描補上安全性

GitHub 趨勢周報 Vol.30:技能包熱門,代理供應鏈掃描補上安全性

推薦閱讀

AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

2026 年 9 月 16 日
黃仁勳籲 AI 監管放手讓業者自理|費城抗議資料中心擴建|AI墳場揭失敗清單|產業精選 09.16

黃仁勳籲 AI 監管放手讓業者自理|費城抗議資料中心擴建|AI墳場揭失敗清單|產業精選 09.16

2026 年 9 月 16 日

從零打造自己的 Linux:Linux from Scratch

2026 年 9 月 16 日

DeepSeek-V4.1-Flash 雙機 GB10 搭配 QNAP NAS 儲存架構實測

2026 年 9 月 15 日
商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域

商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域

2026 年 9 月 15 日

近期熱門

  • 微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決

    微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決

    340 shares
    Share 136 Tweet 85
  • 商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域

    227 shares
    Share 91 Tweet 57
  • 21世紀音樂理論教室:開放教科書如何翻轉大學音樂教育?

    224 shares
    Share 90 Tweet 56
  • GitHub 趨勢周報 Vol.32:技能成為新的散布單位,本地優先工具改以 Rust 重寫

    159 shares
    Share 64 Tweet 40
  • Anthropic 揭 Claude 遭國家級間諜與七家實驗室濫用|AI 趨勢精選 09.14

    147 shares
    Share 59 Tweet 37
  • Sakana AI 推出 Fugu Max 與 Fugu Ultra v2,視覺推論分數超越 Opus 5 與 Fable 5

    147 shares
    Share 59 Tweet 37
  • NVIDIA 營收暴衝 70%、OpenAI Pro 訂閱暫停新戶註冊|產業精選 09.11

    143 shares
    Share 57 Tweet 36
  • Steam Frame 售價 1059 美元起跳,Valve 跨足硬體市場再掀波瀾

    133 shares
    Share 53 Tweet 33
  • Nvidia 執行長直言 AI 減速不可能|OpenAI 豪擲三億收購相機團隊|產業精選 09.15

    128 shares
    Share 51 Tweet 32
  • 大家都該放慢 AI 開發腳步,除了我以外

    124 shares
    Share 50 Tweet 31

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。