CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
聯繫我們
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊
沒有結果
觀看所有搜尋結果
CyberQ 賽博客
沒有結果
觀看所有搜尋結果
  • 首頁
  • 熱門
  • AI 人工智慧
  • 資安
  • Docker
  • 進階應用
  • 網通
  • NAS
  • 開箱測試
  • 教學
  • 展覽直擊
首頁 新聞 AI 人工智慧

AI 攻克博士級數學難題?菲爾茲獎得主 Timothy Gowers 與 ChatGPT 5.5 Pro 的震撼接觸

Ashley Hsieh by Ashley Hsieh
2026 年 05 月 09 日 12:30
in AI 人工智慧, 新聞
閱讀時間: 2 分鐘
A A
AI 攻克博士級數學難題?菲爾茲獎得主 Timothy Gowers 與 ChatGPT 5.5 Pro 的震撼接觸
9.3k
觀看數
分享到臉書分享到 X分享到Line分享到 Threads分享到 Linkedin

知名菲爾茲獎得主、數學家 Timothy Gowers 日前在其個人部落格發表了一篇文章《A recent experience with ChatGPT 5.5 Pro》,引起不少關注和討論。Gowers 在原文開頭表示,ChatGPT 5.5 Pro 在幾乎沒有他提供嚴肅數學提示的情況下,於約一小時左右的互動過程中,產出了一段可被視為博士級研究水準的數學成果。需要注意的是,這裡的一小時左右是對整體互動與成果整理的概括描述,其中第一個關鍵構造,模型實際花了 17 分 5 秒完成。

RELATED POSTS

小米開源 MiMo v2.6 模型,手機大廠搶進 AI 推理戰場

OpenAI 數學突破引監管焦慮|Meta Muse 美加下載量超越 ChatGPT|產業精選 09.22

xAI 推出 Grok 4.7|Anthropic 揭露 Claude 已主導 26% 內部研發|AI 趨勢精選 09.22

17 分鐘提出關鍵構造

Gowers 在文章中提到,他將數學家 Mel Nathanson 關於加性數論(Additive Number Theory)中一個尚未完全解決的問題交給了 ChatGPT 5.5 Pro。問題探討的是在特定條件下,集合的直徑需要多大。令人驚訝的是,這款 AI 模型進行了約 17 分鐘的「思考」後,給出了一個二次方的上限(quadratic upper bound)構造,這顯然是最佳的可能解。隨後,AI 僅花了 2 分多鐘便將論證過程轉換成了標準的 LaTeX 數學預印本格式。Gowers 在仔細驗證後,確認了該證明的正確性。

Gowers 後來問的是,能不能把 Isaac Rajagopal 原本對一般 h 的結果再改進。這不是單純 h=2 的問題,而是更一般、更複雜的版本。這裡 ChatGPT 先做了一個從 exponential in k 改進到 exponential in k^(1/2+ε)」的中間成果,花了 16 分 41 秒,再寫成 preprint,花了 47 分 39 秒。這一段加起來約 64 分鐘。

Gowers 接著又要求 ChatGPT 嘗試推到 polynomial bound。ChatGPT 花 13 分 33 秒提出方向,再花 9 分 12 秒檢查技術命題,最後花 31 分 40 秒寫成 preprint。這三段加起來約 54 分 25 秒,這個想法是「original and clever」,而且 ChatGPT 用不到一小時找到並證明。這裡的「不到一小時」指的就是 polynomial bound 這個關鍵進展本身,不包括前面那個較例行的中間改進與第一次 preprint 整理。

Gowers 和 AI 的互動過程,並不是指整個實驗從頭到尾只花一小時,而是指其中一項關鍵研究成果在約一小時內完成。若把後續針對一般 h 的多輪推導、中間結果、技術檢查與兩次預印本整理全部加總,時間則接近兩小時。換言之,17 分鐘是第一個 h=2 問題的關鍵構造時間,約一小時是後續 polynomial bound 這項核心突破的時間,接近兩小時則是更完整的第二階段互動總耗時,而這樣的成果,正為大家驚艷。

對照業界測試

AI 早已在科學領域展露頭角 Gowers 的經歷並非孤例。回顧 OpenAI 在 2025 年 11 月發布的《Early experiments in accelerating science with GPT-5》報告,當時的模型已經展現出強大的數理邏輯能力,例如在物理學領域成功輔助重建了克爾黑洞(Kerr black hole)波動方程中隱藏的對稱代數。

然而,Gowers 這次對 ChatGPT 5.5 Pro 的測試進一步證明,AI 的能力已經在輔助整合已知結果這段固然已經不錯,如今更進化到了獨立推理並解決開放性學術問題,能力確實更上一層樓。

數學研究的危機與未來

正如《Startup Fortune》在近期的報導《Timothy Gowers says AI is forcing mathematics to rethink research》中所指出的,Gowers 提到的危機並不是指數學問題會被窮盡,而是指向了學術界的訓練機制與學術信用。傳統上,這類中等難度的開放性問題正是博士生用來鍛鍊研究能力的重要階梯,如今 AI 能夠輕易完成這項工作,未來的數學家該如何訓練?學術界又該如何認定研究貢獻?

CyberQ 認為,隨著大型語言模型不斷刷新我們對其數理能力的評估上限,人類科學家與 AI 的協作模式又有更好的進展,很值得關注和期待未來的進展。

史丹佛 2026 年 AI 指數報告解析科技突破與安全風險的平衡
一日抵半年!新一代 AI 科學家 Kosmos 突破 LLM 記憶極限,單次運算可讀千篇論文,成功驗證 7 項科學發現
沒學歷也能進 OpenAI 當工程師,AI 時代大學教育價值正在崩解
Anthropic 研究員以「馬被引擎取代」為例,示警 AI 替代人類速度恐超乎想像
Anthropic CEO 警告:人類社會尚未成熟到足以駕馭超知能
2026 年 AI 部署趨勢:量子 AI、Agentic AI 與地端 / 混合雲運算全面導入的推論經濟學
GPT-5.5 變成數位好同事 ? 市場走向全自主全自主 AI 代理時代
標籤: AIChatGPTChatGPT 5.5ChatGPT 5.5 Pro
Share112Tweet70ShareShareShare20
上一篇

PHP 8.5.6 與 8.4.21 正式發布:多項 CVE 漏洞修復與 JIT 引擎除錯

下一篇

高階 AI 模型出現情緒反應與拒答現象 專家探討 AI 受苦的可能性

Ashley Hsieh

Ashley Hsieh

專案管理者與 UI/UX 設計、AI美術設計認證、淨零碳規劃管理師,在上市歐洲外商、生醫、金融、科技產業中淬煉,曾參與過多個跨平台專案,從需求分析、設計、使用者測試到專案交付流程都樂在其中。 私底下,我是一位「喜歡買東西但錢包容易抗議」的人,對科技、設計與藝術有熱情,正在努力平衡質感生活,學習和錢包一起成長的日常小練習者。

相關文章

小米開源 MiMo v2.6 模型,手機大廠搶進 AI 推理戰場
AI 人工智慧

小米開源 MiMo v2.6 模型,手機大廠搶進 AI 推理戰場

2026 年 9 月 22 日
OpenAI 數學突破引監管焦慮|Meta Muse 美加下載量超越 ChatGPT|產業精選 09.22
新聞

OpenAI 數學突破引監管焦慮|Meta Muse 美加下載量超越 ChatGPT|產業精選 09.22

2026 年 9 月 22 日
xAI 推出 Grok 4.7|Anthropic 揭露 Claude 已主導 26% 內部研發|AI 趨勢精選 09.22
AI 人工智慧

xAI 推出 Grok 4.7|Anthropic 揭露 Claude 已主導 26% 內部研發|AI 趨勢精選 09.22

2026 年 9 月 22 日
AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21
新聞

AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

2026 年 9 月 21 日
華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休
新聞

華倫提案禁止私募基金持有醫療診所,醫療商品化爭議不休

2026 年 9 月 21 日
Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權
AI 人工智慧

Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權

2026 年 9 月 20 日
下一篇
高階 AI 模型出現情緒反應與拒答現象 專家探討 AI 受苦的可能性

高階 AI 模型出現情緒反應與拒答現象 專家探討 AI 受苦的可能性

Bun 真的要從 Zig 改寫成 Rust 嗎?AI 輔助重構進入系統軟體核心的壓力測試

Bun 真的要從 Zig 改寫成 Rust 嗎?AI 輔助重構進入系統軟體核心的壓力測試

Gemini API File Search 升級多模態 RAG,企業 NAS 正走向 AI 知識中樞

Gemini API File Search 升級多模態 RAG,企業 NAS 正走向 AI 知識中樞

推薦閱讀

小米開源 MiMo v2.6 模型,手機大廠搶進 AI 推理戰場

小米開源 MiMo v2.6 模型,手機大廠搶進 AI 推理戰場

2026 年 9 月 22 日
OpenAI 數學突破引監管焦慮|Meta Muse 美加下載量超越 ChatGPT|產業精選 09.22

OpenAI 數學突破引監管焦慮|Meta Muse 美加下載量超越 ChatGPT|產業精選 09.22

2026 年 9 月 22 日
xAI 推出 Grok 4.7|Anthropic 揭露 Claude 已主導 26% 內部研發|AI 趨勢精選 09.22

xAI 推出 Grok 4.7|Anthropic 揭露 Claude 已主導 26% 內部研發|AI 趨勢精選 09.22

2026 年 9 月 22 日
能自動分類就不要依賴生成,參考 JEV 概念實作本機小模型當決策判斷引擎

能自動分類就不要依賴生成,參考 JEV 概念實作本機小模型當決策判斷引擎

2026 年 9 月 21 日
AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

AI 巨頭放緩喊假的?|世界模型黑箱?|Qwen 開源新局|產業精選 09.21

2026 年 9 月 21 日

近期熱門

  • ChatGPT 共同發明人推出 Jev 模型,每秒 10 次決策即時玩 Doom,每小時成本約 7 美元

    ChatGPT 共同發明人推出 Jev 模型,每秒 10 次決策即時玩 Doom,每小時成本約 7 美元

    222 shares
    Share 89 Tweet 56
  • AI什麼都能問,人類還需要背東西嗎?研究揭記憶仍是批判思考基礎

    247 shares
    Share 99 Tweet 62
  • 能自動分類就不要依賴生成,參考 JEV 概念實作本機小模型當決策判斷引擎

    192 shares
    Share 77 Tweet 48
  • 揭開 Hacker News 排名演算法:評分、爭議與懲罰機制解析

    179 shares
    Share 72 Tweet 45
  • Claude Code 開始讀取 AGENTS.md:跨工具協作時代來臨

    161 shares
    Share 64 Tweet 40
  • Qwen-Image-2.1 開放權重下載,7B 單一模型整合生圖與編輯,授權改採研究授權

    159 shares
    Share 64 Tweet 40
  • 用 40 億參數小模型改寫查詢計畫,速度比 Postgres 快上 81%

    153 shares
    Share 61 Tweet 38
  • GitHub 趨勢周報 Vol.33,代理基礎設施補上稽核與去敏感資料,瀏覽器代理改走結構化狀態路線

    151 shares
    Share 60 Tweet 38
  • Hister:為你造訪過的網頁與收藏檔案而生的私有搜尋引擎

    140 shares
    Share 56 Tweet 35
  • AI幻覺險引爆美軍行動|新創孵化器 Vantora 押注實體AI|產業精選 09.19

    138 shares
    Share 55 Tweet 35

關於 CyberQ 賽博客

CyberQ 賽博客網站的命名正是 Cyber + Q ,是賽博網路、資訊、共識 / 高可用叢集、量子科技與品質的綜合體。

我們專注於企業級網路與儲存環境建構、NAS 系統整合、資安解決方案與 AI 應用顧問服務。透過以下三大面向的「Q」核心元素,我們為您提供從基礎架構到資料智慧的雙引擎驅動力:

Quorum 與 Quantum-safe

在技術架構上,是基於信任的基礎架構,CyberQ 深入掌握分散式系統中的 Quorum(一致性)、Queue(任務調度) 與 QoS(服務品質),以 Quick(效率) 解決複雜的 IT 與資安問題。同時,我們積極投入 Quantum-safe(後量子密碼學) 等新興資安領域,確保企業基礎設施在未來運算時代具備堅不可摧的長期競爭力。

Query 與 Quotient

CyberQ 是協助企業成長的 AI 引擎,在堅韌的架構之上,我們透過 Query(洞察) 解析大量資料,並以 Quotient(提升企業科技智商) 的顧問服務,將 AI 導入本機端環境與自動化工作流程中,將資料轉化為企業最具價值的數位資產。

Quest與 Quantum Leap

專業媒體與技術顧問是我們的核心雙動能。

作為科技媒體,我們秉持駭客精神持續進行科技 Quest(探索),探索海內外產業動態。

作為顧問團隊,我們結合多年第一線實務經驗,提供量身打造的最佳化解決方案,協助企業完成數位轉型的 Quantum Leap(躍進)。

新聞稿、採訪、授權、內容投訴、行銷合作、投稿刊登:[email protected]
廣告委刊、展覽會議、系統整合、資安顧問、業務提攜:[email protected]

Copyright ©2026 CyberQ.tw All Rights Reserved.

沒有結果
觀看所有搜尋結果
  • 首頁
    • 關於我們
    • 隱私權政策
  • 熱門
  • AI 人工智慧
    • AI 應用實戰
    • AI 代理
  • 資安
    • ISO 合規
  • Docker
    • 虛擬化
  • 進階應用
    • DevOps
    • 程式開發
    • 企業解決方案
  • 網通
    • 100GbE
    • 10GbE
  • NAS
  • 開箱測試
    • 選購指南
  • 教學
    • DR.Q 快問快答
  • 展覽直擊

© 2025 CyberQ NAS、資安、資訊科技、AI應用的日常 關於 CyberQ 賽博客 NAS 系統與電腦、手機一起的生活故事 多年的系統整合與資訊安全經驗,協助智慧家居、小型工作室、辦公室與機構,導入更便利、更安全的資訊環境與應用。