25 位菲爾茲獎(數學界的諾貝爾獎)得主共同發表聲明,呼籲人工智慧公司不要再將解決數學難題作為 LLM 的考券
聲明發表於陶哲軒(2006 年菲爾茲獎得主)的部落格,外界普遍認為此聲明針對的是 OpenAI 於 9 月 8 日發表的論文有關,該論文宣稱公司內部未公開的模型解決了千禧年大獎難題,發現了三維納維-斯托克斯方程的有限時間爆破。
究竟是頂尖學者無法接受新科技,還是大公司仗勢欺人?雖然我認為 AI 將大幅度改變文明的進程,但了解此次事件後,我認為公理站在數學家那一邊。
主要原因有三:
-
形式化驗證 Lean 跑通不代表證明成功
現代複雜數學證明會使用專門軟體 Lean,其特色是只要 Lean 程式碼能執行成功,且程式碼中不包含 sorry 這種例外字句,那就絕對是一個邏輯自洽的證明過程。但 Lean 語言本身存在局限性,無法完全描述數學問題其本質或物理現象。因此邏輯正確不代表證明成功,最簡單的例子就是在假設前提裡直接加入要被證明的結果,那就該證明就恆為真。
-
論文證明的內容與題目的數學意義不完全相關
使用 AI 證明數學問題時,許多操作者甚至不太了解該命題完整脈絡,與其相關的數學工具(這部分 OpenAI 還有在聲明中特別提到,作為 AI 強大到用的人不完全懂也能證明成功的補充)。論文中主要說明的操作者如何透過是高階策略大綱指揮 agent,例如 agent 是如何將大問題拆解成幾千個子問題,用了哪些搜尋演算法與提示策略等。以及列出證明中關鍵的中間步驟例如演算法在第 300 萬次搜尋時發現了性質 A,進而導出性質 B。實際證明代表的數學與物理意義,與傳統由數學家證明的論文中差異極大,而最終這些鴻溝還是需要數學家去完成。
-
誇大事實誤導大眾
解決千禧年大獎問題需要滿足「發布於合格期刊受全球同行評審」、「發布後經過至少兩年沉澱」與「獲得全球數學界的普遍接受」等三點才會被克雷研究所接受。OpenAI 自行宣稱解決問題,但實際上根本沒有走完整個流程。現在就說「第二個千禧年難題已被解決」還為時過早,充其量只能說是可能的證明,正等待獨立驗證與同行評審。
以後再看到 AI 又突破了什麼領域的重大新聞,可以先想想這些公司要的是什麼?當你把他們的利益跟聲明「對齊」來看,就能發現其背後的小心機。