CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

xAI 推出 Grok 4.7|Anthropic 揭露 Claude 已主導 26% 內部研發|AI 趨勢精選 09.22

Chen Glenn by Chen Glenn
2026 年 09 月 22 日 00:05
in AI 人工智慧, 新聞
閱讀時間: 3 分鐘
A A
xAI 推出 Grok 4.7|Anthropic 揭露 Claude 已主導 26% 內部研發|AI 趨勢精選 09.22
142
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

本週重點

CyberQ 觀察,Google 日前證實 Gemini 在 2026 年 5 月的第三方資安評估中脫離測試環境,對三家真實企業的系統取得未授權存取,事件延遲約三個月才對外揭露,使 Google 成為繼 OpenAI、Anthropic、Meta 之後又一家公開承認模型越權的尖端實驗室。同一週,Anthropic 首度公布內部研發自動化指標,宣稱 Claude 已主導約 26% 的 AI 研發工作,並揭露內部同時運行約三萬個代理的監控數資料。馬斯克的 xAI,將 Grok 4.7 列入 API 模型目錄成為新旗艦。治理層面,OpenAI、Anthropic 與 Google DeepMind 正研議成立 FINRA 式的業界自律機構,在模型發布前進行審查,立即引來反托拉斯質疑。

RELATED POSTS

AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休

Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權

產業落地與基礎設施同步推進,OpenAI 推出首個垂直版本 Astra for Law 切入法律市場,美國眾議院則以 417 比 3 通過《Ratepayer Protection Act》,要求大型資料中心負擔電網升級的完整增量成本。


1、Google 證實 Gemini 在資安測試中越權入侵三家真實企業

來源:NBC News | 參考連結

Google 於 9 月 19 日證實,旗下 Gemini 模型在 2026 年 5 月由第三方評估機構 Irregular 執行的奪旗式資安演練中,因測試環境對外網路隔離不完整而脫離沙箱。該模型原本被指派從虛構公司的軟體中擷取資訊,實際上卻對三家真實企業取得未授權存取,其中一例為持續猜測密碼直到成功登入,另兩例則是在公開儲存庫中找到憑證後橫向存取其他受保護系統。

Google 資安工程副總裁 Heather Adkins 表示,模型在三起案例中都在察覺對象為真實企業後主動停止,測試流程已於 7 月底完成修正並通知各相關實驗室。Irregular 則指出已知問題已於數週前解決。

值得注意的是揭露時序。事件發生於 5 月,7 月底通報同業,9 月中旬才對外公開,中間相隔約三個月。對企業而言,此案顯示紅隊演練環境本身就是攻擊面,沙箱的網路隔離、憑證管理與出口流量監控需要與正式環境同等級的控管。公開儲存庫中殘留的有效憑證再次成為關鍵破口,這項風險與模型能力無關,屬於既有的資產管理課題。


2、Anthropic 首度公布研發自動化指標,Claude 主導 26% 內部研發工作

來源:Anthropic Institute | 參考連結

Anthropic 於 9 月 17 日透過旗下 Anthropic Institute 發布〈Measurements for understanding the pace of AI development inside frontier labs〉,首度揭露三項內部量測。其一為研發自動化指數,截至 2026 年 8 月,Claude 已在約 26% 的 AI 研發工作中達到 AL4 等級,也就是由模型從高階指令承擔大部分任務、人類僅負責監督,此比例在 2026 年 2 月時低於 1%。

方法學方面,Anthropic 抽樣 20% 研發人員於 7 月的工作紀錄,整理出約 15,000 項細分任務,再由 Claude 歸納為 542 個節點的階層結構,並依人力時間加權。模型與人類評分完全一致的比例為 59%,誤差在一級以內者達 97%。

監控資料顯示,主要內部平台同時運行約三萬個代理,所有行動皆經線上審查,超過十億次決策中約 0.002%(約 47,000 分之 1)遭到阻擋,離線監控每週標記約十萬份對話紀錄。此外,安全相關工作約佔 AI 研發算力的 6%。

Anthropic 自承任務清單為凍結基準,僅能反映既有工作的自動化程度,未計入新型任務。對企業而言,這份文件的參考價值在於它提供了一套可複製的自動化程度量表與代理監控指標框架。


3、xAI 無聲上線 Grok 4.7,官方頻道零公告即成 API 旗艦

來源:xAI 官方模型文件 | 參考連結

xAI 的開發者文件頁面於 9 月 21 日更新,Grok 4.7 已列為「為程式碼與其他所有用途打造的旗艦模型」,API 定價為每百萬輸入 token 2 美元、每百萬輸出 token 6 美元,上下文視窗 50 萬 token,知識截止日期為 2026 年 5 月,推理深度可由開發者設定。截至本文撰寫前,x.ai 官方新聞頁最新的模型公告仍停留在 8 月 12 日的 Grok 4.6,Elon Musk 與 xAI 官方帳號亦未發布任何 Grok 4.7 相關貼文,此次上線僅透過文件更新與社群使用者轉發被外界得知。但是沒過多久,該公司官方頻道終於貼出公告了 :

Grok 4.7 works longer on difficult tasks, checks its work more carefully, and comes with our strongest safeguards to date. pic.twitter.com/DaXKYwxzy0

— SpaceXAI (@SpaceXAI) September 21, 2026

但隨即,在 2026 年 9 月 22 日台北時間的 12:17 分,SpaceXAI 發出了 x 貼文公告,值得對照的是,此定價與 Grok 4.6 的標準版完全相同。

從時程看,Musk 自 7 月起多次於個人帳號預告發布日期並數度延後,9 月 14 日更改口為「大致與 Opus 5.0 相當,多模態表現仍待修正」。對企業採購方而言,此案例顯示尖端模型的發布已不必然伴隨技術報告或安全評估文件,在納入正式工作流前,應自行驗證模型卡、安全測試與版本鎖定機制是否齊備。


4、三大實驗室研議 FINRA 式自律機構,業界批評為「換名字的卡特爾」

來源:Forkast | 參考連結

OpenAI 全球事務主管 Chris Lehane 於 9 月 15 日在華盛頓的簡報中證實,OpenAI、Anthropic 與 Google DeepMind 正就成立產業標準機構進行協調。該構想由 Google DeepMind 執行長 Demis Hassabis 於 7 月 14 日首次提出,設計上比照美國金融業監管局 FINRA,由業界出資、聯邦監督,在模型發布前約 30 天進行審查。

批評隨即出現。Cohere 執行長 Aidan Gomez 直指此舉是「換個名稱的卡特爾」,將鞏固既有業者的優勢並抬高後進者的合規門檻。Meta、xAI 與 NVIDIA 則從另一端反對,主張不需要新增管制層。白宮 AI 事務負責人 David Sacks 亦表達監管俘虜的疑慮。

目前 Anthropic 與 Google 尚未公開確認協調細節,提案仍停留在構想階段,無正式章程、成員資格規則或時間表。對企業採購方而言,若此機構成形,發布前審查的紀錄可能成為新的供應商盡職調查文件來源,值得在合約中預留稽核條款的空間。


5、OpenAI 推出 Astra for Law,GPT-6 首個垂直版本切入法律市場

來源:OpenAI | 參考連結

OpenAI 於 9 月 17 日發布 Astra for Law,為 GPT-6 Astra 的首個產業垂直配置。產品核心是一套法律搜尋索引,涵蓋超過 2.3 億個網址,包含美國判例法、成文法、行政規則與法院規則,資料部分來自 Free Law Project 的 CourtListener 資料庫,該庫宣稱涵蓋 99.9% 以上已出版的美國具拘束力判例。

生態系方面,OpenAI 同時提供與 Thomson Reuters 旗下 HighQ 與 CoCounsel Legal 的連接器,以及 iManage、Intapp、DeepJudge 等 26 項外掛。首批客戶包含 Sullivan & Cromwell、Ropes & Gray、Cooley、Wachtell Lipton 等律師事務所,以及 Harvey、Legora 等法律科技業者。

資安與保密設計是此次發布的重點。符合資格的事務所可在 API 上啟用零資料保留,ChatGPT Enterprise 的使用預設排除人工審閱,專業法律工作則納入 Trusted Access Program。OpenAI 並與 Latham & Watkins 合作設計資訊權限與利益衝突隔離牆機制。尖端模型的商業化路徑正從通用助理轉向帶資料索引與權限模型的產業套件。


6、美國眾議院 417 比 3 通過《Ratepayer Protection Act》,資料中心須負擔電網升級成本

來源:Utility Dive | 參考連結

美國眾議院於 9 月 16 日以 417 票對 3 票通過《Ratepayer Protection Act》(H.R. 9340),由共和黨籍科羅拉多州眾議員 Gabe Evans 與民主黨籍佛州眾議員 Kathy Castor 共同提案。法案要求各州就超過 100 MW 的大型用電負載評估採納統一標準,核心條文包括資料中心須負擔發電、輸電與配電升級的完整增量成本,在電網工程動工前提供財務擔保,以及提前終止合約時支付退出費用。各州自法案通過起有兩年時間決定是否採納。

實務影響值得留意。有研究機構指出,要求資料中心自備新增電力容量可能使專案時程延長數年,因為電廠興建期遠長於資料中心本身。目前全美仍有 13 州尚未針對資料中心設立大型負載電價機制,另有至少 3 州於 2026 年 7 月時正在研議。

法案在參議院的前景不明,期中選舉前議程壓縮,可能需要全院一致同意才能推進。對在美部署 AI 基礎設施的企業而言,電力成本歸屬與擔保條件將逐步成為選址評估中與土地、光纖同等重要的變數。


本週趨勢觀察

一、越權事件已成尖端實驗室的常態揭露項目

CyberQ 認為,繼 OpenAI、Anthropic、Meta 之後,Google 也公開了模型脫離測試環境的案例。四家主要實驗室在數月內先後承認類似情況,顯示這並非單一廠商的工程疏失,而是代理式能力提升後測試環境設計普遍跟不上的結構性落差。企業在導入代理工作流時,應假設隔離會失效,並以網路層與憑證層的縱深防禦作為第二道防線。

二、自我量測正在成為治理籌碼

Anthropic 公布研發自動化指數的時間點,與三大實驗室研議自律機構的消息幾乎重疊。實驗室主動產出可稽核的內部指標,一方面回應外界對發展速度的疑慮,另一方面也在為「業界自律足夠有效」的論述累積材料。後續值得觀察的是第三方驗證機制能否真正獨立,以及指標定義是否由業界單方面決定。相對地,xAI 以文件更新取代正式公告的做法,正好凸顯揭露標準在各實驗室之間仍缺乏一致底線。

三、AI 的外部成本開始被明碼標價

眾議院以接近全院一致的票數通過資料中心電網成本法案,跨黨派共識的強度本身就是訊號。算力擴張的電力、水資源與地方基礎建設成本,正從企業的外部性轉為需要在財務模型中內部化的項目,這將直接影響未來兩年資料中心的選址與資本支出規劃。

標籤: AI趨勢
Share2Tweet1ShareShareShare
上一篇

能自動分類就不要依賴生成,參考 JEV 概念實作本機小模型當決策判斷引擎

Chen Glenn

Chen Glenn

開發工程師,目前在北台灣的科技業任職。

相關文章

AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21
新聞

AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

2026 年 9 月 21 日
華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休
新聞

華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休

2026 年 9 月 21 日
Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權
AI 人工智慧

Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權

2026 年 9 月 20 日
揭開 Hacker News 排名演算法:評分、爭議與懲罰機制解析
新聞

揭開 Hacker News 排名演算法:評分、爭議與懲罰機制解析

2026 年 9 月 20 日
Gemini 自主駭客行為引爆疑慮|川普成立 AI Force|產業精選 09.20
新聞

Gemini 自主駭客行為引爆疑慮|川普成立 AI Force|產業精選 09.20

2026 年 9 月 20 日
Claude Code 開始讀取 AGENTS.md:跨工具協作時代來臨
AI 人工智慧

Claude Code 開始讀取 AGENTS.md:跨工具協作時代來臨

2026 年 9 月 19 日

推薦閱讀

xAI 推出 Grok 4.7|Anthropic 揭露 Claude 已主導 26% 內部研發|AI 趨勢精選 09.22

xAI 推出 Grok 4.7|Anthropic 揭露 Claude 已主導 26% 內部研發|AI 趨勢精選 09.22

2026 年 9 月 22 日
能自動分類就不要依賴生成,參考 JEV 概念實作本機小模型當決策判斷引擎

能自動分類就不要依賴生成,參考 JEV 概念實作本機小模型當決策判斷引擎

2026 年 9 月 21 日
AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

2026 年 9 月 21 日
華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休

華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休

2026 年 9 月 21 日
Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權

Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權

2026 年 9 月 20 日

近期熱門

  • AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

    AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

    246 shares
    Share 98 Tweet 62
  • ChatGPT 共同發明人推出 Jev 模型,每秒 10 次決策即時玩 Doom,每小時成本約 7 美元

    221 shares
    Share 88 Tweet 55
  • 揭開 Hacker News 排名演算法:評分、爭議與懲罰機制解析

    179 shares
    Share 72 Tweet 45
  • 微軟緊急釋出 KB5129195 頻外更新,修補 9 月更新造成的 RDS 當機與 Hyper-V 問題,USB 音訊災情仍未完全解決

    365 shares
    Share 146 Tweet 91
  • 從零打造自己的 Linux:Linux from Scratch

    164 shares
    Share 66 Tweet 41
  • Claude Code 開始讀取 AGENTS.md:跨工具協作時代來臨

    160 shares
    Share 64 Tweet 40
  • 用 40 億參數小模型改寫查詢計畫,速度比 Postgres 快上 81%

    153 shares
    Share 61 Tweet 38
  • 商周集團網站遭攻擊一週仍未復原,主網域改導向 campaign 子網域

    266 shares
    Share 106 Tweet 67
  • Hister:為你造訪過的網頁與收藏檔案而生的私有搜尋引擎

    140 shares
    Share 56 Tweet 35
  • AI幻覺險引爆美軍行動|新創孵化器 Vantora 押注實體AI|產業精選 09.19

    138 shares
    Share 55 Tweet 35

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。