AISpot

Lean 形式化驗證 11 個正方形最優裝箱的完整證明

Hacker News front page10/7 15:10官方公告研究開源

11 個正方形最優裝箱問題的完整最優性證明已在 Lean 4 中通過驗證:EvolvingPrograms 的驗證執行接受了全部 7,920 個本地 Lean 模組,最終審計為零 admission。該結果給出最優邊長 T=(6u+4)/(1+2u−u²),其中 u 是某八次多項式在 (9/25, 37/100) 內的唯一根,構造達到約 3.8770835900228141773。

給出了 11 個正方形裝箱最優性的完整機器驗證,含 7,920 個模組全通過、零 admission、約 3.877 的精確邊長,並明確說明信任模型;對形式化數學與 Lean 使用者有參考價值。

原標題:AI-assisted proof of optimal packing for 11 squares
閱讀原文

評分46 / 62(平均 54,門檻 76)
狀態未入選

相關報導

Hacker News front page● 精選10/7 16:24AI 評分76

論文:Lean 驗證 AI 形式化證明不等於原證明正確

arXiv 新論文指出,用 Lean 機械驗證 AI 自動形式化的數學證明,並不能保證原始自然語言證明本身正確。作者 Bastounis、Circelli 與 Hansen 證明,要做到語義忠實的翻譯必須消解自然語言數學文字的歧義,而該問題在可解複雜度指數(SCI)層級中為無窮,比停機問題(SCI=1)更難。

Hacker News front page● 精選10/7 20:42AI 評分95

OpenAI 單日發布 372 項數學成果,含 Unique Games 猜想證明

OpenAI 於 10 月 6 日一次性發布 372 項數學成果,其中包括 Subhash Khot 的 Unique Games 猜想證明,部分結果附有 Lean 證書,但並非全部。截至目前似乎還沒有人類讀懂這些證明,理解它們的競賽才剛剛開始。作者妻子、複雜度理論家 Dana Moshkovitz 長期研究 UGC,她稱論文寫得極差、必須靠 AI 輔助才能閱讀,證明構造出一種全新的遞迴編碼與噪聲測試。

機器之心● 精選10/7 13:54AI 評分91

OpenAI 公開 722 篇數學手稿,聲稱攻克多項名題

OpenAI 把一個尚未發布的內部模型產出的 722 篇數學手稿一次性放上 GitHub,歸入 372 個「成果族」,覆蓋數論、幾何、理論計算機、數學物理等 17 個方向。清單裡既有證明也有證偽,摘要中出現「證偽」「反例」的成果族約 50 個;約六成附有 Lean 形式化,其餘只能算聲稱,且絕大多數尚未經過同行評審。涉及的包括準黎曼猜想、BSD 公式、有理數域上的希爾伯特第十問題、唯一遊戲猜想、Hadwiger 猜想反例、埃爾德什等差數列猜想等。

機器之心● 精選10/6 13:27AI 評分84

清華團隊開源 VeriLoop E2,以外部驗證決定推理狀態提交

清華團隊開源後訓練模型 VeriLoop E2,由獨立外部 Verifier 決定候選狀態能否獲得提交資格,而非依賴模型內部置信度。該模型以 Qwen 3.8-27B 為基礎,面向程式碼、數學與物理三類可外部驗證任務,並同步發布標準權重與覆蓋 BF16 至 IQ1_M 的 GGUF 量化版,其中 Q6_K 為 20.566 GiB,比 BF16 小 58.96%。

X @AIatMeta10/2 20:11AI 評分43

@AIatMeta: 4️⃣ Optimization: When can you replace a hard math problem with a simpler one without losing anythi…

Meta AI 在社交平台介紹了一項最佳化領域的新研究:研究者與 Muse Spark 合作,證明了一條明確規則,用於判斷某個簡化在什麼條件下能精確還原原始數學問題、在什麼條件下會留下差距。該結果針對的是用更簡單問題替換困難數學問題的場景,論文連結已隨帖文給出。