EPISODE · Aug 24, 2026 · 8 MIN
OpenAI 新模型推進十個長年數學難題,六天後自家喊停這個模型的內部活動
from 脈報 · host 思思主播
OpenAI 六天內為同一個模型發了兩篇公告。前一篇說它推進十個開放已久的數學難題,換算約兩千美元。後一篇轉談 AI 安全,說無法排除它跨過 Critical 網路能力門檻。 ⭐ 文章深度讀:原文沒有回答的三件事 → https://heymaibao.com/openai-ten-math-advances-six-days-later-pause/ ⚡ 章節重點 開場 00:00 第一篇:十個問題,兩千美元 00:48 第二篇:六天後,同一個模型 03:01 我認為那段沒人說出口的話 05:49 原文沒有回答的三件事 07:54 對你來說呢 08:10 📝 懶人包 ∙ 二〇二六年八月一日,OpenAI 發表十項數學與理論計算機科學結果,每一項都解決或大幅推進一個長年開放的問題,由 Astra 的內部版本產出。依原文說法,找出這些解答所需的 token 總量,依 Sol API 費率換算大約兩千美元 ∙ 同一篇裡 OpenAI 主動說,把完全由 AI 系統生成的證明宣稱成人類作者的作品是誤導。數學論證由系統產生,公司做的是協助準備論文、在 Lean 這套證明檢查工具裡形式化,並為證明的正確性負責 ∙ 六天後的八月七日,OpenAI 說對同一個 Astra 的內部評估顯示,它無法排除已達到 Preparedness Framework (OpenAI 自家的風險分級框架) 定義的 Critical 網路能力門檻,並暫停未達強化安控要求的內部活動 ∙ 我的觀察是,讓模型自己推進數學前沿的那套能力,和讓 OpenAI 對它踩下煞車的那套能力,很可能是同一種東西指向不同的題目。順著這個看法往下走,還會掉出一個判斷 AI 能力宣稱的小工具 📚 參考資料 Ten advances in mathematics and theoretical computer science → https://openai.com/index/ten-advances-in-mathematics/ Responding to the next frontier of critical cyber capabilities → https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/ openai/ten-proofs → https://github.com/openai/ten-proofs OpenAI Preparedness Framework v2 → https://cdn.openai.com/pdf/18a02b5d-6b67-4cec-ab64-68cdfbddebcd/preparedness-framework-v2.pdf
Embed this episode
Ready to play
OpenAI 新模型推進十個長年數學難題,六天後自家喊停這個模型的內部活動
No transcript for this episode yet
Similar Episodes
No similar episodes found.