CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

Chen Glenn by Chen Glenn
2026 年 08 月 05 日 17:17
in AI 人工智慧, 新聞
閱讀時間: 2 分鐘
A A
Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent
3.7k
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

隨著自律型 AI Agent 應用的迅速崛起,能夠自動規劃任務、呼叫工具並完成多步驟複雜工作流程的系統,已成為新一代軟體開發的核心趨勢。過去這類強大的 Agent 服務極度依賴雲端伺服器的運算資源與大型模型,使得在效能與記憶體受限的手機或筆記型電腦等消費級裝置上進行本機執行,始終被視為難以克服的瓶頸。

RELATED POSTS

AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休

Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權

近期 Liquid AI 發布了最新的輕量化模型 LFM2.5-2.6B,這項技術成果迅速引發科技圈與資安領域的廣泛關注。CyberQ 觀察 Liquid AI 官方公告,這款僅有 26.9 億參數(2.69B)的小型模型,不僅能完全在裝置端獨立執行,還能在工具調用與多步驟 Agent 任務中,展現出媲美甚至超越四倍體積大型模型的性能,讓智慧型手機順暢執行小型地端 AI Agent 成為可能。

Liquid AI 的四位共同創辦人皆來自麻省理工學院計算機科學與人工智慧實驗室(MIT CSAIL),團隊背景主要涵蓋奧地利、伊朗、羅馬尼亞與美國,擔任執行長(CEO)的 Ramin Hasani 為伊朗裔奧地利籍學者,出生於伊朗,後於奧地利維也納科技大學取得博士學位。擔任技術長(CTO)的 Mathias Lechner 為奧地利籍,同樣畢業於維也納科技大學與奧地利科技學院。擔任 CSO 的 Alexander Amini 為美國人,出生於德州並於麻省理工學院取得學士至博士學位。另一位共同創辦人 Daniela Rus 則是羅馬尼亞裔美國人,出生於東歐的羅馬尼亞,現為 MIT CSAIL 的主任與教授。

突破規模瓶頸的架構與訓練機制

LFM2.5-2.6B 擁有 30 層網路結構,並採用高達 34 兆(34 Trillion)Token 的預訓練資料量。為了強化多語言支援能力,開發團隊將詞彙表擴展至 128,000 個 Token,並提供長達 131,072 Token 的上下文視窗,完整涵蓋繁體中文與日語等多國語言需求。

與傳統僅透過合成資料訓練的小模型不同,Liquid AI 採用了極為獨特的 post-training 訓練流程。模型直接在目前最流行的 Agent 執行架構內進行強化學習,結合多領域專家模型的知識蒸餾技術,針對指令遵循、工具呼叫、網路搜尋與軟體工程等真實任務進行深入塑形。這種訓練策略讓 LFM2.5-2.6B 獲得了不錯的相容性,在基準測試中,其工具使用與指令執行表現不僅直逼大型模型,甚至在部分 Agent 評測指標中一舉超越了 Qwen3.5-9B。

驚人的推論速度與硬體適應力

在實際推論速度方面,LFM2.5-2.6B 展現出不錯的硬體執行效率。在中央處理器(CPU)的解碼速度測試中,蘋果 Apple M5 Max 晶片可達到每秒 220 Token 的驚人速度,AMD Ryzen AI Max+ 395 亦具備每秒 113 Token 的處理能力。即便是運算資源相對有限的智慧型手機,也能維持每秒 30 Token 左右的穩定輸出,完全滿足即時互動與自主 AI Agent 任務的執行需求。

對於企業級或資料中心環境,當使用 NVIDIA H100 GPU 進行高併發處理時,該模型的解碼速度更可飆升至每秒約 15,000 Token,單日輸出量高達 13 億 Token。為滿足不同開發情境的需求,Liquid AI 除了提供原生模型權重外,亦同步釋出了適用於 llama.cpp 的 GGUF 量化版本、跨平台的 ONNX Runtime 格式,以及針對 Apple Silicon 最佳化的 MLX 格式,並區分為預訓練基底模型 LFM2.5-2.6B-Base 與後訓練版 LFM2.5-2.6B,降低了社群開發者的部署門檻。

邊緣端 AI Agent 的市場趨勢與資安隱私效益

從市場趨勢與資訊安全合規的角度來看,LFM2.5-2.6B 的登場代表著 AI 應用正式進入「去雲端化」與「邊緣 AI」的新階段。將 AI Agent 的運算重心從雲端轉移至終端裝置,最直觀的效益在於歸零的 Token 呼叫成本與極低的網路延遲,這讓開發者能夠大幅平行化部署多個 Agent 協同工作,而不必擔心龐大的 API 費用帳單。

更重要的是,地端跑這種小型代理人,為企業與個人資料安全在終端小型裝置上帶來了革命性的保護。傳統雲端 Agent 往往需要將敏感的個人資料、商業機密或系統存取權限傳輸至第三方伺服器,衍生出嚴重的資料外洩與資安合規風險。當 AI Agent 能夠完全離線並在本地端執行時,所有資料存取與工具調用均鎖定在裝置內部,從根本上杜絕了資料傳輸過程中的截獲疑慮,非常適合應用於金融、醫療及企業內部敏感流程的自動化。

雖然在複雜程式碼撰寫與多模態視覺處理等特定領域,規模較大的 Gemma 4 或 Qwen3.5 等模型依然保有相對優勢,但 LFM2.5-2.6B 的發表算是開啟了另一條路線,透過架構設計與真實場景的強化學習,小型邊緣模型也能跑 AI Agent 代理人,未來終端裝置就不只是雲端 AI 的顯示螢幕,增加了具備簡單獨立思考與行動能力。

CyberQ 認為,這些裝置如果使用這些模型,其實可以看出適合的是小型裝置。

裝置適合程度用途
手機 / Android★★★★★個人 AI Agent、Tool Calling、離線助理
Raspberry Pi 5★★★★☆IoT Agent、Home Automation、設備控制
Intel Core Ultra / AMD Ryzen AI★★★★★本機 Agent、AIOps、Automation
產線 QC、物流機器★★★★☆能發展的方向
RTX 5060 Ti 16GB★★★★★可以跑,但有點「大材小用」
NVIDIA + NAS★★★★★NAS 上跑本地 Agent 很合適
NVIDIA DGX Spark GB10★★★★☆可以跑,但不應該只拿它跑 2.6B
QNAP NAS CPU★★★★☆非常適合做輕量常駐 Agent
Snapdragon X / Snapdragon 手機★★★★★這類硬體正是它的主要戰場
MCU / 超低階 IoT★☆☆☆☆2.6B 還是太大,應該看 230M/350M

可以它定位成小型 AI Controller 可能會比小型 ChatGPT 更適合,搭配代理人程式會較值得在小型裝置使用。

首圖由 Nano Banana AI 生成

GitHub 趨勢週報 Vol.9:邊緣運算升溫,把 LLM 塞進你的手機
QNAP AI NAS Edge AI 方案與自建 DGX Spark 地端 LLM 架構比較
Ollama 0.31 導入多 Token 預測技術,邊緣端執行 Gemma 4 效能提升近九成
標籤: LFM2.5LFM2.5-2.6BLiquid AIMIT CSAILOn-device AIRamin Hasani去雲端化智慧型手機AI自律型AI代理人輕量化AI模型邊緣端AI Agent
Share44Tweet28ShareShareShare8
上一篇

Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片

下一篇

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

Chen Glenn

Chen Glenn

開發工程師,目前在北台灣的科技業任職。

相關文章

AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21
新聞

AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

2026 年 9 月 21 日
華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休
新聞

華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休

2026 年 9 月 21 日
Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權
AI 人工智慧

Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權

2026 年 9 月 20 日
揭開 Hacker News 排名演算法:評分、爭議與懲罰機制解析
新聞

揭開 Hacker News 排名演算法:評分、爭議與懲罰機制解析

2026 年 9 月 20 日
Gemini 自主駭客行為引爆疑慮|川普成立 AI Force|產業精選 09.20
新聞

Gemini 自主駭客行為引爆疑慮|川普成立 AI Force|產業精選 09.20

2026 年 9 月 20 日
Claude Code 開始讀取 AGENTS.md:跨工具協作時代來臨
AI 人工智慧

Claude Code 開始讀取 AGENTS.md:跨工具協作時代來臨

2026 年 9 月 19 日
下一篇
Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

記憶體成本狂飆!AI算力排擠效應引起的軟體瘦身革命

記憶體成本狂飆!AI算力排擠效應引起的軟體瘦身革命

Marvell推Structera X與光學共享記憶體

Marvell推Structera X與光學共享記憶體

推薦閱讀

能自動分類就不要依賴生成,參考 JEV 概念實作本機小模型當決策判斷引擎

能自動分類就不要依賴生成,參考 JEV 概念實作本機小模型當決策判斷引擎

2026 年 9 月 21 日
AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

2026 年 9 月 21 日
華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休

華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休

2026 年 9 月 21 日
Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權

Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權

2026 年 9 月 20 日
QNAP QSW 網管交換器 4.5.0 韌體實測

QNAP QSW 網管交換器 4.5.0 韌體實測

2026 年 9 月 20 日

近期熱門

  • 微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決

    微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決

    364 shares
    Share 146 Tweet 91
  • 商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域

    266 shares
    Share 106 Tweet 67
  • AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

    246 shares
    Share 98 Tweet 62
  • ChatGPT 共同發明人推出 Jev 模型,每秒 10 次決策即時玩 Doom,每小時成本約 7 美元

    221 shares
    Share 88 Tweet 55
  • 揭開 Hacker News 排名演算法:評分、爭議與懲罰機制解析

    178 shares
    Share 71 Tweet 45
  • 從零打造自己的 Linux:Linux from Scratch

    164 shares
    Share 66 Tweet 41
  • Claude Code 開始讀取 AGENTS.md:跨工具協作時代來臨

    160 shares
    Share 64 Tweet 40
  • 用 40 億參數小模型改寫查詢計畫,速度比 Postgres 快上 81%

    153 shares
    Share 61 Tweet 38
  • Sakana AI 推出 Fugu Max 與 Fugu Ultra v2,視覺推論分數超越 Opus 5 與 Fable 5

    147 shares
    Share 59 Tweet 37
  • Hister:為你造訪過的網頁與收藏檔案而生的私有搜尋引擎

    140 shares
    Share 56 Tweet 35

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。