查證再相信:對照 Clay 研究所的官方認定狀態到 Clay Mathematics Institute 官網查 Millennium Problems 頁面,看納維-斯托克斯問題是否被正式列為「已解決」。判斷標準:只要官網還沒更新狀態,就代表這仍是「單一機構的重大宣稱」,而非「板上釘釘的定論」,先當一則值得追蹤的新聞看待,不急著改寫自己對 AI 能力的認知。
🧠 工程思維透鏡(資深工程師看到的是什麼)
🔭 這代表 AI 已經能做出真正「原創」的數學研究,還是只是把人類已知技巧拼裝得更漂亮?
關鍵在「writeup + Lean 形式化證明」雙軌並行:形式化證明可以被機器逐步驗證正確性,這跟「看起來很像數學」的自然語言證明不同——即使我們還沒辦法完全評估 AI 的洞察力有多「原創」,Lean 至少排除了「人類審稿沒發現邏輯漏洞」這個風險。這也代表評判 AI 數學能力的標準正在轉移:以後該看的是它有沒有附上可驗證的形式化證明,而不是自然語言寫得多漂亮。
這是一場訊號博弈:對外公布重大科研突破,能鞏固「我們站在前沿」的敘事,也會影響監理討論與資本市場預期;但不釋出模型,代表『能力』跟『可用性(productization)』之間存在落差——一般開發者短期內拿不到這個能力。工程師該追的重點不是「AI 又超越人類」這種標題,而是這個能力多久之後會下放到日常會用到的 API 或工具鏈裡。