CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

Mac 本機跑模型速度翻倍!Ollama 正式支援 MLX,釋放 Apple Silicon 潛能

Icewind by Icewind
2026 年 04 月 01 日 13:20
in AI 人工智慧, 新聞
閱讀時間: 2 分鐘
A A
Mac 本機跑模型速度翻倍!Ollama 正式支援 MLX,釋放 Apple Silicon 潛能
3.9k
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

對於廣大的 Mac 開發者與本地端 AI 玩家來說,這可是近期很讓令人開心振奮的消息,知名開源本地 AI 執行工具 Ollama 近日在 X (原 Twitter) 上發布了一則熱門推文,宣佈在最新釋出的 Ollama 0.19 預覽版中,正式將 Apple 專屬的機器學習框架 MLX 納入底層支援。

RELATED POSTS

WordPress 7.1 正式發布,回應式樣式與瀏覽器端媒體處理登場

Stripe 收購 OpenRouter 的真實盤算|Waymo 平價自駕車全面開放|產業精選 08.20

Cursor 挑戰 GitHub 霸主地位|產業精選 08.19

Ollama is now updated to run the fastest on Apple silicon, powered by MLX, Apple's machine learning framework.

This change unlocks much faster performance to accelerate demanding work on macOS:

– Personal assistants like OpenClaw
– Coding agents like Claude Code, OpenCode,… pic.twitter.com/WImO0lyYnp

— ollama (@ollama) March 31, 2026

這項底層架構的重大革新,意味著 Mac 終於能徹底解除封印,發揮 Apple Silicon統一記憶體(Unified Memory)的極致優勢。究竟這次升級帶來了怎樣的效能躍進呢? CyberQ 解析這些核心的重點。

支援 MLX 讓 M5 晶片的神經加速器大顯神威

過去,在 Mac 上執行大語言模型(LLM)多半仰賴 llama.cpp 等泛用框架,雖然相容性極佳,但在面對 Mac 獨特的硬體架構時,往往難以榨乾 100% 的效能。

為了解決這個問題,Ollama 0.19 預覽版直接建構於 Apple 開源的 MLX 框架之上。這讓 CPU 與 GPU 得以實現零拷貝共享同一塊記憶體池,徹底消除資料傳輸的延遲。更驚人的是,在最新的 M5、M5 Pro 與 M5 Max 晶片上,Ollama 能直接調用全新的GPU 神經網路加速器(Neural Accelerators),讓首字元生成(TTFT)與解碼速度獲得有體感的加速。

實測資料公開,解碼速度近乎翻倍!

效能到底提升了多少?官方以阿里巴巴最新開源的 Qwen3.5-35B-A3B 模型進行了嚴格的基準測試(對比 0.18 版與 0.19 MLX 預覽版):

預填充(Prefill / 提示詞處理速度),從 1,154 tokens/s 狂飆至 1,810 tokens/s(提升約 1.56 倍)。

解碼(Decode / 內容生成速度),從 58 tokens/s 躍升至 112 tokens/s(提升高達 93%,幾乎翻倍!)。

官方更預告,若改用 int4 精度量化,預填充速度甚至可上看 1,851 tokens/s,解碼速度達 134 tokens/s。這樣的表現,讓過去需要稍微等待模型思考的空窗期幾乎被抹平,真正實現了隨問隨答的體驗。

導入 NVFP4 格式與專為 AI Agent 打造的智慧快取

除了速度提升,這次更新還帶來了針對進階開發者與自動化代理(Agentic Workflows)的深度最佳化:

支援 NVIDIA NVFP4 量化格式是一大好處,Ollama 導入了 NVFP4 格式支援,能在極限壓縮記憶體頻寬與儲存空間的同時,維持與未壓縮前幾乎無異的模型準確度。這代表開發者在本地 Mac 上,就能獲得與雲端企業級生產環境對齊的輸出品質。

升級版智慧快取(Intelligent Caching),不少用戶常結合 Claude Code、OpenCode 或個人助理 OpenClaw 執行複雜的自動化任務。Ollama 為此徹底最佳化了記憶體管理:

跨對話快取重用(Reuse Cache),當使用共用的系統提示詞(System Prompts)時,能大幅提高快取命中率並降低整體記憶體佔用。

智慧檢查點(Intelligent checkpoints),在 Prompt 的關鍵節點自動儲存快照,當 Agent 進行思考任務分支時,可省去重複處理提詞的時間。

更聰明的清除機制(Smarter eviction),即使舊的對話分支被刪除,共用的上下文前綴也能保留更久,非常適合長時間的寫程式輔助。

硬體門檻與社群實測建議(32GB 記憶體起跳)

雖然這次更新很香,但是呢,要享受良好的本地 AI 體驗也是有硬體門檻的。

Ollama 官方強烈建議:您的 Mac 必須具備至少32GB 以上的統一記憶體。根據 Reddit (r/LocalLLaMA) 科技社群玩家的早期實測,35B 級別的模型載入後大約會吃掉 20GB 的 RAM,剩下約 12GB 留給 KV Cache 運作。

如果你只是進行一般長度的專案對話,32GB 綽綽有餘,但若要處理超長文本,或把 Ollama 作為複雜 Agent 框架的後端,很容易就會觸碰到記憶體天花板並動用到虛擬記憶體(Swap)導致降速。因此,對於重度 AI 開發者來說,配備 48GB 甚至 64GB 記憶體的機型將會是更游刃有餘的完美選擇。

即刻搶先體驗本地 AI 革命

CyberQ 認為,Ollama + Apple MLX ,造福更多本地端 AI 生態系的用戶,繼續讓 Mac 能擔任 AI 開發者設備的好選擇。現在,你只需靠一台高階 Mac,就能擁有媲美雲端 AI 的生成速度,且完全不需擔心商業機密或隱私外洩的風險。

如果你手邊正好有一台規格達標的 Apple Silicon Mac,別猶豫了!立刻下載最新的 Ollama 0.19 預覽版,打開終端機輸入以下指令啟動專為寫程式最佳化的 35B 模型並與之對話,或搭配 Claude Code 等工具於背景啟動:

ollama run qwen3.5:35b-a3b-coding-nvfp4

ollama launch claude –model qwen3.5:35b-a3b-coding-nvfp4

如果對現有自己在 Mac 上跑本地模型覺得不夠快,可以去更新看看 Ollama,這次搭配 MLX 帶來的本地 AI 是有進步的了。

vLLM-Omni 推出,開源 AI 推論引擎新生態與 Ollama 的定位之爭
你們家的 AI 伺服器在網路上裸奔嗎 ? Cisco 揭露上千台 Ollama LLM 設備曝險門戶洞開
在 QNAP NAS 上使用 OLLAMA 執行 AI 模型基礎教學
ComfyUI v0.15.0 原生整合 Gemma 3、重構 LTX-Video,引領全模態混合工作流
標籤: AIAppleApple MLX frameworkM5OLLAMA
Share47Tweet30ShareShareShare8
上一篇

Oracle 預計裁員3萬人 豪賭 AI 基礎建設

下一篇

OpenAI 狂募 1,220 億美元!估值破 8,520 億美元,宣告 AI 超級 App 戰略

Icewind

Icewind

歷經數位內容、電商、資安、AI 與科技產業,擁有多年產業經驗,ISO 27001:2022 LA、ISO 27701:2019 LA。

相關文章

WordPress 7.1 正式發布,回應式樣式與瀏覽器端媒體處理登場
新聞

WordPress 7.1 正式發布,回應式樣式與瀏覽器端媒體處理登場

2026 年 8 月 20 日
新聞

Stripe 收購 OpenRouter 的真實盤算|Waymo 平價自駕車全面開放|產業精選 08.20

2026 年 8 月 20 日
新聞

Cursor 挑戰 GitHub 霸主地位|產業精選 08.19

2026 年 8 月 19 日
GLM-5.3 攻擊性資安能力超出訓練預期權重延後釋出|OpenAI 解散 Preparedness 團隊風險評估責任分散|AI 趨勢週報
AI 人工智慧

GLM-5.3 攻擊性資安能力超出訓練預期權重延後釋出|OpenAI 解散 Preparedness 團隊風險評估責任分散|AI 趨勢週報

2026 年 8 月 18 日
新聞

Anthropic 年化營收暴增至 650 億美元|GitHub 故障意外開啟缺口|產業精選 08.18

2026 年 8 月 18 日
算力即權力?從「每焦耳智慧」看 AI 的集權迷思與去中心化未來
AI 人工智慧

算力即權力?從「每焦耳智慧」看 AI 的集權迷思與去中心化未來

2026 年 8 月 17 日
下一篇
OpenAI 狂募 1,220 億美元!估值破 8,520 億美元,宣告 AI 超級 App 戰略

OpenAI 狂募 1,220 億美元!估值破 8,520 億美元,宣告 AI 超級 App 戰略

測試純 HDD ZFS 的效能極限,Toshiba 1.44 PB 高密度儲存實測報告解析

測試純 HDD ZFS 的效能極限,Toshiba 1.44 PB 高密度儲存實測報告解析

為什麼看起來寫得不夠嚴謹的 Claude Code 能創造 25 億美元營收?50 萬行外流原始碼的拆解啟示

為什麼看起來寫得不夠嚴謹的 Claude Code 能創造 25 億美元營收?50 萬行外流原始碼的拆解啟示

推薦閱讀

WordPress 7.1 正式發布,回應式樣式與瀏覽器端媒體處理登場

WordPress 7.1 正式發布,回應式樣式與瀏覽器端媒體處理登場

2026 年 8 月 20 日

Stripe 收購 OpenRouter 的真實盤算|Waymo 平價自駕車全面開放|產業精選 08.20

2026 年 8 月 20 日
在兩台 DGX Spark 上跑 DeepSeek-V4-Flash:DSpark 值得開,最高加速 57 %

在兩台 DGX Spark 上跑 DeepSeek-V4-Flash:DSpark 值得開,最高加速 57 %

2026 年 8 月 19 日
GB10 上的模型權重該放 SSD 還是 NAS?儲存路徑測試大作戰

GB10 上的模型權重該放 SSD 還是 NAS?儲存路徑測試大作戰

2026 年 8 月 19 日

Cursor 挑戰 GitHub 霸主地位|產業精選 08.19

2026 年 8 月 19 日

近期熱門

  • 實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?

    實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?

    261 shares
    Share 104 Tweet 65
  • DeepSeek Harness 開發者預覽版 + GB10 本機模型的 Agentic 實戰

    195 shares
    Share 78 Tweet 49
  • DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

    177 shares
    Share 71 Tweet 44
  • AI代理人互動量可能超越人類

    153 shares
    Share 61 Tweet 38
  • 在兩台 DGX Spark 上跑 DeepSeek-V4-Flash:DSpark 值得開,最高加速 57 %

    141 shares
    Share 56 Tweet 35
  • GitHub 趨勢周報 Vol.28:DeepSeek Harness 五日破十五萬星,插件生態一週成形

    140 shares
    Share 56 Tweet 35
  • 算力即權力?從「每焦耳智慧」看 AI 的集權迷思與去中心化未來

    139 shares
    Share 56 Tweet 35
  • DeepSeek-V4-Flash-0731 在 GB10 上的取樣/投機解碼實測

    128 shares
    Share 51 Tweet 32
  • Google推出Gemini 3.7 Flash模型 提升程式開發與AI代理效能

    121 shares
    Share 48 Tweet 30
  • GB10 上的模型權重該放 SSD 還是 NAS?儲存路徑測試大作戰

    106 shares
    Share 42 Tweet 27

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。