CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent

Chen Glenn by Chen Glenn
2026 年 08 月 05 日 17:17
in AI 人工智慧, 新聞
閱讀時間: 2 分鐘
A A
Liquid AI 推出 LFM2.5-2.6B,智慧型手機也能順暢執行 AI Agent
3.6k
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

隨著自律型 AI Agent 應用的迅速崛起,能夠自動規劃任務、呼叫工具並完成多步驟複雜工作流程的系統,已成為新一代軟體開發的核心趨勢。過去這類強大的 Agent 服務極度依賴雲端伺服器的運算資源與大型模型,使得在效能與記憶體受限的手機或筆記型電腦等消費級裝置上進行本機執行,始終被視為難以克服的瓶頸。

RELATED POSTS

實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?

如何判斷 AI 平台帳號是否遭駭 ?|Anthropic 揭露 Claude 浮水印技術細節|產業精選 08.16

GLM-5.3 具備進階網路攻擊能力 並已發現Cursor漏洞|AI 自駕卡車加州上路|產業精選 08.15

近期 Liquid AI 發布了最新的輕量化模型 LFM2.5-2.6B,這項技術成果迅速引發科技圈與資安領域的廣泛關注。CyberQ 觀察 Liquid AI 官方公告,這款僅有 26.9 億參數(2.69B)的小型模型,不僅能完全在裝置端獨立執行,還能在工具調用與多步驟 Agent 任務中,展現出媲美甚至超越四倍體積大型模型的性能,讓智慧型手機順暢執行小型地端 AI Agent 成為可能。

Liquid AI 的四位共同創辦人皆來自麻省理工學院計算機科學與人工智慧實驗室(MIT CSAIL),團隊背景主要涵蓋奧地利、伊朗、羅馬尼亞與美國,擔任執行長(CEO)的 Ramin Hasani 為伊朗裔奧地利籍學者,出生於伊朗,後於奧地利維也納科技大學取得博士學位。擔任技術長(CTO)的 Mathias Lechner 為奧地利籍,同樣畢業於維也納科技大學與奧地利科技學院。擔任 CSO 的 Alexander Amini 為美國人,出生於德州並於麻省理工學院取得學士至博士學位。另一位共同創辦人 Daniela Rus 則是羅馬尼亞裔美國人,出生於東歐的羅馬尼亞,現為 MIT CSAIL 的主任與教授。

突破規模瓶頸的架構與訓練機制

LFM2.5-2.6B 擁有 30 層網路結構,並採用高達 34 兆(34 Trillion)Token 的預訓練資料量。為了強化多語言支援能力,開發團隊將詞彙表擴展至 128,000 個 Token,並提供長達 131,072 Token 的上下文視窗,完整涵蓋繁體中文與日語等多國語言需求。

與傳統僅透過合成資料訓練的小模型不同,Liquid AI 採用了極為獨特的 post-training 訓練流程。模型直接在目前最流行的 Agent 執行架構內進行強化學習,結合多領域專家模型的知識蒸餾技術,針對指令遵循、工具呼叫、網路搜尋與軟體工程等真實任務進行深入塑形。這種訓練策略讓 LFM2.5-2.6B 獲得了不錯的相容性,在基準測試中,其工具使用與指令執行表現不僅直逼大型模型,甚至在部分 Agent 評測指標中一舉超越了 Qwen3.5-9B。

驚人的推論速度與硬體適應力

在實際推論速度方面,LFM2.5-2.6B 展現出不錯的硬體執行效率。在中央處理器(CPU)的解碼速度測試中,蘋果 Apple M5 Max 晶片可達到每秒 220 Token 的驚人速度,AMD Ryzen AI Max+ 395 亦具備每秒 113 Token 的處理能力。即便是運算資源相對有限的智慧型手機,也能維持每秒 30 Token 左右的穩定輸出,完全滿足即時互動與自主 AI Agent 任務的執行需求。

對於企業級或資料中心環境,當使用 NVIDIA H100 GPU 進行高併發處理時,該模型的解碼速度更可飆升至每秒約 15,000 Token,單日輸出量高達 13 億 Token。為滿足不同開發情境的需求,Liquid AI 除了提供原生模型權重外,亦同步釋出了適用於 llama.cpp 的 GGUF 量化版本、跨平台的 ONNX Runtime 格式,以及針對 Apple Silicon 最佳化的 MLX 格式,並區分為預訓練基底模型 LFM2.5-2.6B-Base 與後訓練版 LFM2.5-2.6B,降低了社群開發者的部署門檻。

邊緣端 AI Agent 的市場趨勢與資安隱私效益

從市場趨勢與資訊安全合規的角度來看,LFM2.5-2.6B 的登場代表著 AI 應用正式進入「去雲端化」與「邊緣 AI」的新階段。將 AI Agent 的運算重心從雲端轉移至終端裝置,最直觀的效益在於歸零的 Token 呼叫成本與極低的網路延遲,這讓開發者能夠大幅平行化部署多個 Agent 協同工作,而不必擔心龐大的 API 費用帳單。

更重要的是,地端跑這種小型代理人,為企業與個人資料安全在終端小型裝置上帶來了革命性的保護。傳統雲端 Agent 往往需要將敏感的個人資料、商業機密或系統存取權限傳輸至第三方伺服器,衍生出嚴重的資料外洩與資安合規風險。當 AI Agent 能夠完全離線並在本地端執行時,所有資料存取與工具調用均鎖定在裝置內部,從根本上杜絕了資料傳輸過程中的截獲疑慮,非常適合應用於金融、醫療及企業內部敏感流程的自動化。

雖然在複雜程式碼撰寫與多模態視覺處理等特定領域,規模較大的 Gemma 4 或 Qwen3.5 等模型依然保有相對優勢,但 LFM2.5-2.6B 的發表算是開啟了另一條路線,透過架構設計與真實場景的強化學習,小型邊緣模型也能跑 AI Agent 代理人,未來終端裝置就不只是雲端 AI 的顯示螢幕,增加了具備簡單獨立思考與行動能力。

CyberQ 認為,這些裝置如果使用這些模型,其實可以看出適合的是小型裝置。

裝置適合程度用途
手機 / Android★★★★★個人 AI Agent、Tool Calling、離線助理
Raspberry Pi 5★★★★☆IoT Agent、Home Automation、設備控制
Intel Core Ultra / AMD Ryzen AI★★★★★本機 Agent、AIOps、Automation
產線 QC、物流機器★★★★☆能發展的方向
RTX 5060 Ti 16GB★★★★★可以跑,但有點「大材小用」
NVIDIA + NAS★★★★★NAS 上跑本地 Agent 很合適
NVIDIA DGX Spark GB10★★★★☆可以跑,但不應該只拿它跑 2.6B
QNAP NAS CPU★★★★☆非常適合做輕量常駐 Agent
Snapdragon X / Snapdragon 手機★★★★★這類硬體正是它的主要戰場
MCU / 超低階 IoT★☆☆☆☆2.6B 還是太大,應該看 230M/350M

可以它定位成小型 AI Controller 可能會比小型 ChatGPT 更適合,搭配代理人程式會較值得在小型裝置使用。

首圖由 Nano Banana AI 生成

GitHub 趨勢週報 Vol.9:邊緣運算升溫,把 LLM 塞進你的手機
QNAP AI NAS Edge AI 方案與自建 DGX Spark 地端 LLM 架構比較
Ollama 0.31 導入多 Token 預測技術,邊緣端執行 Gemma 4 效能提升近九成
標籤: LFM2.5LFM2.5-2.6BLiquid AIMIT CSAILOn-device AIRamin Hasani去雲端化智慧型手機AI自律型AI代理人輕量化AI模型邊緣端AI Agent
Share43Tweet27ShareShareShare8
上一篇

Mistral AI 推出 Shieldstral 以自然語言政策審查文字與圖片

下一篇

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

Chen Glenn

Chen Glenn

開發工程師,目前在北台灣的科技業任職。

相關文章

實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?
AI 應用實戰

實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?

2026 年 8 月 16 日
新聞

如何判斷 AI 平台帳號是否遭駭 ?|Anthropic 揭露 Claude 浮水印技術細節|產業精選 08.16

2026 年 8 月 16 日
新聞

GLM-5.3 具備進階網路攻擊能力 並已發現Cursor漏洞|AI 自駕卡車加州上路|產業精選 08.15

2026 年 8 月 15 日
DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構
AI 人工智慧

DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

2026 年 8 月 14 日
Google推出Gemini 3.7 Flash模型 提升程式開發與AI代理效能
AI 人工智慧

Google推出Gemini 3.7 Flash模型 提升程式開發與AI代理效能

2026 年 8 月 14 日
Claude 代理衝突測試揭露自主失控風險|DeepSeek-V4-Pro 正式版釋出|產業精選 08.14
新聞

Claude 代理衝突測試揭露自主失控風險|DeepSeek-V4-Pro 正式版釋出|產業精選 08.14

2026 年 8 月 14 日
下一篇
Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

Anthropic Mythos 5 虛構身分誘騙人類通過惡意程式碼

記憶體成本狂飆!AI算力排擠效應引起的軟體瘦身革命

記憶體成本狂飆!AI算力排擠效應引起的軟體瘦身革命

Marvell推Structera X與光學共享記憶體

Marvell推Structera X與光學共享記憶體

推薦閱讀

DeepSeek-V4-Flash-0731 在 GB10 上的取樣/投機解碼實測

DeepSeek-V4-Flash-0731 在 GB10 上的取樣/投機解碼實測

2026 年 8 月 16 日
實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?

實測 Qwen3.8-27B,在 DGX Spark 上的投機解碼到底能快多少?

2026 年 8 月 16 日

如何判斷 AI 平台帳號是否遭駭 ?|Anthropic 揭露 Claude 浮水印技術細節|產業精選 08.16

2026 年 8 月 16 日

GLM-5.3 具備進階網路攻擊能力 並已發現Cursor漏洞|AI 自駕卡車加州上路|產業精選 08.15

2026 年 8 月 15 日
DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

2026 年 8 月 14 日

近期熱門

  • AI 親密機器人被看好,成人市場可能成為家用人型機器人率先落地的入口

    AI 親密機器人被看好,成人市場可能成為家用人型機器人率先落地的入口

    1387 shares
    Share 555 Tweet 347
  • Windows 11 更新 KB5121003 釋出,改善不少但須留意 Secure Boot 憑證換發地雷

    235 shares
    Share 94 Tweet 59
  • 同量級速度卻差 14 倍?LTX-2.5 與 MiniMax-H3 在 DGX Spark 上的 ComfyUI 部署實測

    227 shares
    Share 91 Tweet 57
  • DGX Spark 實戰 Muse-Glimmer-30B:NVFP4 + DFlash 讓本地 AI Agent 速度提升 6 倍

    224 shares
    Share 90 Tweet 56
  • DeepSeek Harness 開發者預覽版 + GB10 本機模型的 Agentic 實戰

    189 shares
    Share 76 Tweet 47
  • DGX Spark + NAS 實測 Muse-Glimmer-30B 跑 AIME 2026 對照 Meta 官方數字

    179 shares
    Share 72 Tweet 45
  • DeepSeek V4 Pro 0813 正式版上線:跑分輸 Kimi K3,卻可能改寫雲端與地端 AI 的成本結構

    173 shares
    Share 69 Tweet 43
  • Qwen 3.8 開放權重可下載:Max 級 2.4T 模型首次開源,27B 亦值得期待

    155 shares
    Share 62 Tweet 39
  • GitHub 趨勢周報 Vol.27:兆級參數落地消費級硬體,AI 資安研究工具走向產品化

    139 shares
    Share 56 Tweet 35
  • Meta 開源 Muse Glimmer 30B 將本地 AI Agent 進入「單卡可跑」時代 ?

    122 shares
    Share 49 Tweet 31

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。