CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

Qwen Image AI 圖像模型效果佳,本地端 AI 算圖新選擇

Icewind by Icewind
2025 年 08 月 07 日 08:00
in AI 人工智慧, AI 應用實戰, 首頁
閱讀時間: 3 分鐘
A A
Qwen Image AI 圖像模型效果佳,本地端 AI 算圖新選擇
1.1k
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

你是否常覺得許多 AI 圖像生成模型對於文字應用在圖片上常常做不夠好或出現亂碼字? 除了英文外,其他語言文字未能盡善盡美? 繼 Black Forest Labs 的 FLUX.1 Kontext 將這方面效果做得更好後,近期 AI 算圖領域出現了一個新挑戰者,也就是中國阿里巴巴集團旗下「通義千問」(Qwen)團隊所開發的最新開源圖像生成模型 Qwen Image AI。

RELATED POSTS

DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

Google推出Gemini 3.7 Flash模型 提升程式開發與AI代理效能

DeepSeek Harness 開發者預覽版 + GB10 本機模型的 Agentic 實戰

Qwen Image AI 有多特別呢? 它可以正確地將中文字顯示在 AI 生成的圖片中,已經是接近商業用的品質,加上它的出圖效果優秀,迅速在全球 AI 社群中引起廣泛討論與關注。

姑且不論有沒有人為去加分,但根據阿里巴巴他們自己公開讓全球網友盲測圖片的網站 AI Arena ,其最新的 AI 圖像生成模型排行榜,Qwen Image 的表現已能與業界最頂尖的 AI 算圖模型並駕齊驅,為使用者提供了一個除了新秀FLUX.1 Kontext、老字號 Stable Diffusion 外,更加強大且可自訂的本地端 AI 算圖新選擇。

不僅懂畫,亦懂文字:Qwen Image 的優勢

傳統的 AI 圖像生成模型,長久以來在圖片中精準生成文字方面存在技術瓶頸,常出現文字錯亂、語意不符或無法處理複雜排版等問題。Qwen Image AI 的出現,採用一個擁有 200 億參數的多模態 DiT (Diffusion Transformer) 架構,並透過大量的圖文資料進行訓練,使其在理解和生成包含精確文字的圖像有比以往的模型表現再好一些。

圖片上文字功能: 無論是單行標題、多行段落,甚至是中英雙語混排,Qwen Image 都能完成,並保持語意的連貫性。這對於需要製作海報、簡報、資訊圖表等內容的創作者而言,是不錯的效果。但我們實際在本機上用 NVIDIA 顯示卡測試,在一堆文字的情況下,它還是會有錯誤的字元出現,但大部分能正確顯示出簡體中文字,繁體中文字有的還不一定完全正確,如下圖所示。

圖像編輯功能: Qwen Image 的圖像編輯功能,透過提示詞再對現有圖像進行風格轉換、物件增刪、細節強化,以及人物姿態的調整,增加後製彈性。

目前在實務上,已經可以在 Hugging Face 等網站下載 Qwen Image 模型來使用,我們則是使用 ComfyUI 搭配工作流來實測 :

AI Arena 排行榜上的成績

除了強大的功能,Qwen Image 的生成品質如果用盲測的話,會是怎樣的成績呢? 在由阿里巴巴自己做的全球使用者匿名投票評比網站,也就是前面我們提到的 AI Arena 圖像生成模型排行榜上,Qwen-Image 表現是看得到的,其主要成績如下:

綜合排名第三: 以2025年8月的數字來看,Qwen Image 以 1023 的 Elo 評分,僅次於 Google 的 Imagen 4 Ultra Preview 和字節跳動的 Seedream 3.0,居排行榜第三。

超越知名模型: Qwen Image 的評分超越了部分知名的競爭對手,包括 OpenAI 的 GPT Image 1 [High](987分)、Black Forest Labs 的 FLUX.1 Kontext [Pro](961分)以及 Ideogram 3.0(942分)。

如果不考慮線上的 AI 算圖模型,單純看可以在本地端跑的所有開源模型中,Qwen Image 的盲測排名可說是第一了,和 Black Forest Labs 的 FLUX.1 Kontext 產出相比,有不少部分是勝出的。

開源釋出意味著不只是本地端部署,還包括社群自己訓練出來的衍生版模型

相較於 Midjourney 等閉源的雲端服務,Qwen Image AI 的另一大吸引力在於其開源的特性。模型以 Apache 2.0 授權條款釋出,允許個人和企業自由地進行商業和非商業性的使用、修改與再發布。

和社群目前熱門的 FLUX.1 Kontext 一樣,使用者也不再需要將資料上傳至第三方伺服器,即可在自己的電腦上進行 AI 算圖,不僅保障了資料的隱私性與安全性,更提供了無限制的創作自由度,很多NSFW 的圖或被限制不能生成的圖,在這些開源模型中是可生成的。

目前,Qwen Image 的模型已在 Hugging Face 和 Github 等平台上公開,開發者和進階使用者可以根據官方提供的指南,將模型部署在本地端的個人電腦或伺服器上。雖然其 200 億的參數規模對硬體,特別是顯示卡記憶體(VRAM)有一定要求(官方建議需要 20GB 以上的顯卡會比較適合),但隨著社群對模型進行量化(Quantization)等最佳化技術的推進,在 16GB 顯卡上搭配 CPU 使用來執行已經成為可能,未來有機會在更廣泛的消費級顯卡的機器上執行。

Qwen Image AI 不僅在生成品質上備受矚目,其文字渲染能力算是改善了我們在業界關注的一項難題。想試試看比較沒有限制的創作嗎?

試試看在你自己的電腦、伺服器或 QNAP NAS 上去實作吧,在具備 NVIDIA 顯示卡的 NAS 上可以使用容器管理工具,在 ComfyUI 的容器中,掛載 Qwen Image 的 Node 來使用,下載對應的模型和相關檔案便能如上圖我們測試環境中去執行。

官方提供的技術文件

官方提供的測試連結 (在千問的頁面選圖像)

下載 Qwen Image 模型 : Hugging Face

本文最上方的標題特色圖片,由 AI 所產生。

標籤: AIAI產圖QwenQwen Image
Share14Tweet9ShareShareShare2
上一篇

Claude Opus 4.1 登場,程式開發再上一層樓,Anthropic 預告近日將再推更強大 AI 模型

下一篇

GPT-5 登場 API 大降價,聚焦 AI 程式開發輔助與自動選取模型

Icewind

Icewind

歷經數位內容、電商、資安、AI 與科技產業,擁有多年產業經驗,ISO 27001:2022 LA、ISO 27701:2019 LA。

相關文章

DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構
AI 人工智慧

DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

2026 年 8 月 14 日
Google推出Gemini 3.7 Flash模型 提升程式開發與AI代理效能
AI 人工智慧

Google推出Gemini 3.7 Flash模型 提升程式開發與AI代理效能

2026 年 8 月 14 日
DeepSeek Harness 開發者預覽版 + GB10 本機模型的 Agentic 實戰
AI 應用實戰

DeepSeek Harness 開發者預覽版 + GB10 本機模型的 Agentic 實戰

2026 年 8 月 14 日
同量級速度卻差 14 倍?LTX-2.5 與 MiniMax-H3 在 DGX Spark 上的 ComfyUI 部署實測
AI 應用實戰

同量級速度卻差 14 倍?LTX-2.5 與 MiniMax-H3 在 DGX Spark 上的 ComfyUI 部署實測

2026 年 8 月 13 日
Qwen 3.8 開放權重可下載:Max 級 2.4T 模型首次開源,27B 亦值得期待
AI 人工智慧

Qwen 3.8 開放權重可下載:Max 級 2.4T 模型首次開源,27B 亦值得期待

2026 年 8 月 12 日
Nvidia 開發參數破兆的 Nemotron 4 開源模型挑戰對手
AI 人工智慧

Nvidia 開發參數破兆的 Nemotron 4 開源模型挑戰對手

2026 年 8 月 12 日
下一篇
GPT-5 登場 API 大降價,聚焦 AI 程式開發輔助與自動選取模型

GPT-5 登場 API 大降價,聚焦 AI 程式開發輔助與自動選取模型

主要 AI 模型 API 價格比較 (2025年8月版)

主要 AI 模型 API 價格比較 (2025年8月版)

GPT-5 上線 24 小時後,OpenAI 為何向「死去 AI 摯友」的用戶道歉?

GPT-5 上線 24 小時後,OpenAI 為何向「死去 AI 摯友」的用戶道歉?

推薦閱讀

GLM-5.3 具備進階網路攻擊能力 並已發現Cursor漏洞|AI 自駕卡車加州上路|產業精選 08.15

2026 年 8 月 15 日
DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

2026 年 8 月 14 日
Google推出Gemini 3.7 Flash模型 提升程式開發與AI代理效能

Google推出Gemini 3.7 Flash模型 提升程式開發與AI代理效能

2026 年 8 月 14 日
Claude 代理衝突測試揭露自主失控風險|DeepSeek-V4-Pro 正式版釋出|產業精選 08.14

Claude 代理衝突測試揭露自主失控風險|DeepSeek-V4-Pro 正式版釋出|產業精選 08.14

2026 年 8 月 14 日
DeepSeek Harness 開發者預覽版 + GB10 本機模型的 Agentic 實戰

DeepSeek Harness 開發者預覽版 + GB10 本機模型的 Agentic 實戰

2026 年 8 月 14 日

近期熱門

  • AI 親密機器人被看好,成人市場可能成為家用人型機器人率先落地的入口

    AI 親密機器人被看好,成人市場可能成為家用人型機器人率先落地的入口

    1386 shares
    Share 554 Tweet 347
  • Windows 11 更新 KB5121003 釋出,改善不少但須留意 Secure Boot 憑證換發地雷

    230 shares
    Share 92 Tweet 58
  • DGX Spark 實戰 Muse-Glimmer-30B:NVFP4 + DFlash 讓本地 AI Agent 速度提升 6 倍

    223 shares
    Share 89 Tweet 56
  • 同量級速度卻差 14 倍?LTX-2.5 與 MiniMax-H3 在 DGX Spark 上的 ComfyUI 部署實測

    222 shares
    Share 89 Tweet 56
  • DeepSeek Harness 開發者預覽版 + GB10 本機模型的 Agentic 實戰

    177 shares
    Share 71 Tweet 44
  • DGX Spark + NAS 實測 Muse-Glimmer-30B 跑 AIME 2026 對照 Meta 官方數字

    173 shares
    Share 69 Tweet 43
  • ComfyUI 0.31.0 盡收主流地端影像模型,DGX Spark + QNAP NAS 的實戰架構

    159 shares
    Share 64 Tweet 40
  • Qwen 3.8 開放權重可下載:Max 級 2.4T 模型首次開源,27B 亦值得期待

    154 shares
    Share 62 Tweet 39
  • DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

    154 shares
    Share 62 Tweet 39
  • GitHub 趨勢周報 Vol.27:兆級參數落地消費級硬體,AI 資安研究工具走向產品化

    139 shares
    Share 56 Tweet 35

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。