CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

Qwen3 系列模型再升級,從頂尖程式碼能力到多模態 AI 的全面進化

Icewind by Icewind
2025 年 09 月 24 日 23:45
in AI 人工智慧, 新聞
閱讀時間: 3 分鐘
A A
Qwen3 系列模型再升級,從頂尖程式碼能力到多模態 AI 的全面進化
488
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

阿里雲(Alibaba Cloud)旗下的人工智慧團隊近期發表了其大規模語言模型 Qwen 系列的最新一代 Qwen3,從旗艦模型、視覺語言能力到全新的內容生成技術,全面展示了其在 AI 領域的強大企圖心與技術實力。

RELATED POSTS

Anthropic 推出 Claude Sonnet 5.5:新一代中型模型再度拉高性價比天花板

OpenAI 因安全疑慮棄用新模型、AMD 投資 82 億美元收購 World Labs|產業精選 09.29

AI 也要學會快思慢想,後設認知如何讓人工智慧更聰明

我們如果從下載數字來看,通義千問已累計開放 300+開源模型,覆蓋全尺寸、全模態模型,開源模型下載量已經突破6億次。這次新推出的該模型預訓練資料量達36T tokens,總參數超過兆,擁有極強的Coding程式設計能力和 AI Agent)=工具調用能力。

Qwen3-Max:挑戰程式碼開發與 AI 代理能力更上一層樓

作為系列中的旗艦模型,Qwen3-Max 在編碼(Coding)和代理(Agent)能力上獲得了顯著增強。根據官方資料,Qwen3-Max-Instruct 在多項權威評測中,無需經過複雜的思考鏈(Chain-of-Thought)或推理步驟,即可在 SWE-BenchMax、Tau2-Bench、SuperGPQA、LiveCodeBench 及 AIME25 等指標上不輸全球頂尖模型。

在處理真實世界問題的 SWE-Bench Verified 測試中,Instruct 版本斬獲69.6分,在聚焦Agent工具調用能力的Tau2-Bench測試中,Qwen3-Max取得突破性的74.8分,超過 Claude Opus4 和 DeepSeek-V3.1。

Qwen3-Max-Thinking-Heavy 在聚焦數學推理的AIME 25和HMMT測試中,均達到突破性的滿分100分。

這次的 Qwen3 系列模型升級意味著 Qwen3-Max 不僅在傳統的語言理解與生成任務上表現出色,更在需要高度邏輯推理和實作能力的專業領域,如軟體開發和複雜問題解決上,有不錯的成果。該公司官方文件已經開放讓各界使用 API 去呼叫 Qwen3-Max 來進行自己專案開發。

由於 Qwen 系列 API 完全相容 OpenAI API 格式,開發者可直接沿用 OpenAI 呼叫方式。以下是一個使用 Python 呼叫 Qwen3-Max-Instruct 的程式碼範例:

from openai import OpenAI
import os

client = OpenAI(
api_key=os.getenv(“API_KEY”),
base_url=”https://dashscope-intl.aliyuncs.com/compatible-mode/v1″,
)

completion = client.chat.completions.create(
model=”qwen3-max”,
messages=[
{‘role’: ‘user’, ‘content’: ‘Give me a short introduction to large language model.’}
]
)

print(completion.choices[0].message)

Qwen3-VL:從「看見」到「推理行動」的視覺語言模型

此模型不僅提升了對圖像的理解能力,更進化到能夠進行深度推理與採取行動,實現了從「看」(See)到「理解」(Understand),再到「推理與行動」(Reasoning and Action)的進步。

Qwen3-VL 推出了兩種不同定位的版本,以滿足多元化的應用需求:Instruct 版本,專為「直接執行、操作代理、日常應用」而設計。根據官方數據,其在多項視覺基準測試中的表現已超越 Google 的 Gemini 2.5 Pro,特別適合需要快速反應與精準執行的場景。

Thinking 版本,則專注於「深度推理、科研數學、長文本處理」。此版本在多模態推理能力上達到了業界頂尖(SOTA)水準,能應對更為複雜和需要深思熟慮的學術及專業任務。換言之,模態 AI 不再僅是簡單的圖像描述,而是具備了分析、推理並與數位世界互動的綜合能力。

Qwen3 加上 WAN 2.5 引起開發者社群高度關注

那麼,這次 Qwen3 系列與前代相比究竟有何不同?如果說前代模型是能力均衡的「全能通才」,Qwen3 則演化為特定任務時的「專家」,不再滿足於樣樣通,而是追求在特定領域的表現。例如,旗艦模型 Qwen3-Max 在程式碼與 Agent 能力上已能與世界頂級模型並駕齊驅,其強大的內在邏輯甚至無需複雜的提示工程就能處理高難度任務。同樣地,專為深度思考設計的 Qwen3-VL Thinking 版本,也直接鎖定過去模型難以處理的複雜學術研究,將「深度推理」打造成核心產品特性。

其次,是從「模組組合」到「原生多模態」的架構演進。過去的模型更像是將語言、視覺等功能分別開發再拼湊起來,而 Qwen3 從底層設計就統一考量該如何處理文字、圖像、聲音等多種不同的資料格式。

最新的 WAN-2.5 模型則更進一步地把「文字生成影片與聲音」這件事情做到更好,它所產生影片的效果,已經不輸 Google 的 Veo 3。

Qwen3 家族與 WAN 系列:建構全面的 AI 生態系

此次升級最顯著的變化之一,是其清晰完整的產品線佈局。Qwen3 形成了一個分工明確的「模型矩陣」,搭配全新的內容生成 WAN 系列,共同建構出一個全面的 AI 生態系。

Qwen3 系列產品結構:
Qwen3-Max (旗艦): 具備頂尖效能的核心模型。
Qwen3-VL (視覺語言): 從理解到行動的多模態專家。
Qwen3-Omni (全模態): 整合各種模態能力的通用模型。
Qwen3-Coder-Plus (程式強化): 專為程式碼開發升級的專業版。
Qwen3-Next (效率最佳化): 兼顧效能與資源效率的模型。

WAN 系列:
WAN-2.5-Preview: 最新的文生影像與聲音模型,其技術目標直接對標 Google 的 Veo 3,預期將在多媒體內容創作領域將吸引到不少創作者與開發者投入。

CyberQ 認為,Qwen3 系列的發表,意義不只在於模型的升級,而是再次凸顯是中國 AI 技術團隊在底層技術到多元應用的表現已經在全球 AI 市場站穩腳步,如果說過去的 Qwen 系列為阿里雲累積了深厚的技術實力,那麼 Qwen3 就是奠基於此,往更專業、更整合的方向前進。

首圖由 Google Gemini AI 生成

標籤: AIQwenQwen3阿里巴巴阿里雲
Share6Tweet4ShareShareShare1
上一篇

開發者如何使用 AI?Google 2025 DORA 報告解析

下一篇

IBC 2025 現場直擊 – 從 8K 剪輯到 PB 級歸檔:QNAP 高速網路與儲存方案應對國際影視媒體產業資料洪流需求

Icewind

Icewind

歷經數位內容、電商、資安、AI 與科技產業,擁有多年產業經驗,ISO 27001:2022 LA、ISO 27701:2019 LA。

相關文章

Anthropic 推出 Claude Sonnet 5.5:新一代中型模型再度拉高性價比天花板
新聞

Anthropic 推出 Claude Sonnet 5.5:新一代中型模型再度拉高性價比天花板

2026 年 9 月 29 日
新聞

OpenAI 因安全疑慮棄用新模型、AMD 投資 82 億美元收購 World Labs|產業精選 09.29

2026 年 9 月 29 日
AI 人工智慧

AI 也要學會快思慢想,後設認知如何讓人工智慧更聰明

2026 年 9 月 28 日
Google 為什麼變得這麼怪?從搜尋品質到產品策略的深層變化
新聞

Google 為什麼變得這麼怪?從搜尋品質到產品策略的深層變化

2026 年 9 月 28 日
新聞

Anthropic 執行長與川普共進晚餐|Meta AI 信任危機待解|產業精選 09.28

2026 年 9 月 28 日
Reladraw:把「排版主導權」還給你的圖表語言
新聞

Reladraw:把「排版主導權」還給你的圖表語言

2026 年 9 月 27 日
下一篇

IBC 2025 現場直擊 - 從 8K 剪輯到 PB 級歸檔:QNAP 高速網路與儲存方案應對國際影視媒體產業資料洪流需求

選哪一種記憶卡才安心? 從手機、遊戲機、無人機到專業監控,一次搞懂 MicroSD 卡選購指南

選哪一種記憶卡才安心? 從手機、遊戲機、無人機到專業監控,一次搞懂 MicroSD 卡選購指南

NVIDIA 投資 OpenAI 千億美元,攜手 Oracle 打造 AI 算力與資本的永續引擎

NVIDIA 投資 OpenAI 千億美元,攜手 Oracle 打造 AI 算力與資本的永續引擎

推薦閱讀

DGX Spark 中小企業地端 AI 部署實戰,從 1 台到 4 台怎麼配

DGX Spark 中小企業地端 AI 部署實戰,從 1 台到 4 台怎麼配

2026 年 9 月 29 日
Anthropic 推出 Claude Sonnet 5.5:新一代中型模型再度拉高性價比天花板

Anthropic 推出 Claude Sonnet 5.5:新一代中型模型再度拉高性價比天花板

2026 年 9 月 29 日

OpenAI 因安全疑慮棄用新模型、AMD 投資 82 億美元收購 World Labs|產業精選 09.29

2026 年 9 月 29 日
雙機 DGX Spark 實測 DeepSeek-V4.1-Flash Viterbi 2.0bpw

雙機 DGX Spark 實測 DeepSeek-V4.1-Flash Viterbi 2.0bpw

2026 年 9 月 29 日
QNAP TS-h1677AXU-RP 開箱實測:以 RAID 60 陣列擔任 NVIDIA B200 叢集的儲存池

QNAP TS-h1677AXU-RP 開箱實測:以 RAID 60 陣列擔任 NVIDIA B200 叢集的儲存池

2026 年 9 月 29 日

近期熱門

  • GitHub 趨勢周報 Vol.34,閉源決策模型 Jev 發表一週內出現一堆開放權重對照組,型別化決策助地端 AI 如虎添翼

    GitHub 趨勢周報 Vol.34,閉源決策模型 Jev 發表一週內出現一堆開放權重對照組,型別化決策助地端 AI 如虎添翼

    212 shares
    Share 85 Tweet 53
  • Ollaya 登場:把 Jev 式決策模型搬進開源生態,本地推論再添新選項

    206 shares
    Share 82 Tweet 52
  • Ollaya 等 Jev-like 模型放得進 QNAP NAS 跑嗎?DGX Spark 與桌機同場實測

    190 shares
    Share 76 Tweet 48
  • Nexterity 以機器人自動化處理高危險勞動場景|Waymo 車隊自駕規模化加速|產業精選 09.25

    184 shares
    Share 74 Tweet 46
  • 把 NAS 變成網路資安偵測器:ADRA NDR X 1.0.5 實測與適用場域分析

    155 shares
    Share 62 Tweet 39
  • QNAP TS-h1677AXU-RP 開箱實測:以 RAID 60 陣列擔任 NVIDIA B200 叢集的儲存池

    151 shares
    Share 60 Tweet 38
  • 雙機 DGX Spark 實測 DeepSeek-V4.1-Flash Viterbi 2.0bpw

    142 shares
    Share 57 Tweet 36
  • 星星、太陽、月亮到齊,OpenAI GPT-6 三模型佈局與尖端模型價格戰

    144 shares
    Share 58 Tweet 36
  • AI 也要學會快思慢想,後設認知如何讓人工智慧更聰明

    111 shares
    Share 44 Tweet 28
  • 中小企業核心網路升級的新選項:25GbE 上行搭配 L3 Lite 的 QSW-M5218 系列網管型交換器

    105 shares
    Share 42 Tweet 26

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。