aiminute. ← AIニュース一覧
研究 2026-08-20

機械が書いた証明があまりに増えたので、数学者たちは登記所をつくった——二つある検査のうち一つは、言語モデルが担っている

機械が書いた証明があまりに増えたので、数学者たちは登記所をつくった——二つある検査のうち一つは、言語モデルが担っている

テレンス・タオは 8 月 18 日、Lean FRO と ICARM が育成する Lean 検証済み数学の登記所 Palomar が投稿受付を開始したと発表した。対象とする問題は新しい。ここ数か月で、新旧の結果に対する AI 生成の証明が大量に現れ、その相当数が、機械に各段階を確認させられる証明支援系 Lean で形式化されている。しかし GitHub に置かれた Lean のリポジトリは、それ自体では何も説明しない。そのコードが著者の主張どおりのものを証明しているかを見極めるのは実際の労力を要し、Lean を使わない数学者にはほぼ不可能である。Palomar は投稿されたリポジトリを二つの検査にかける。一つ目は機械的なもので、Comparator という Lean のツールが、そのモジュールが型検査を通り、主張どおりの結果をちょうど証明していることを確認する。二つ目は、平易な言葉による説明が形式的な言明と一致しているかを問うもので、こちらは大規模言語モデルが担う。双方を通過したリポジトリが登記され、正確な言明、依拠したライブラリ、査読者の所見が併せて公開される。タオはこれを Lean 証明のためのプレプリントサーバーに相当するものと呼び、Jeremy Avigad、Matthew Ballard、Jaume de Dios、Nestor Guillen、Bryna Kra、Kim Morrison、Ravi Vakil、Akshay Venkatesh とともに科学諮問委員会に名を連ねている。

なぜ重要か数学の査読は、両端に人間というボトルネックがあることを前提にしていた。人が証明を書き、人がそれを読む。機械は前半を壊した。後半はそもそも規模化したことがない。Palomar は、欠けていた配管を敷こうとする最初の本格的な試みであり、その中心にある妥協を率直に述べている。形式的な検査は隙がない。しかし、その形式的言明が本当に誰かの関心事だったのかという問いに答えているのは、まさにこの洪水を引き起こした種類の系である。これは醜聞ではなく、いま取りうる誠実な選択であり、隠されずに明示されている。より大きな含意は、ある分野が機械の産物を受け入れるかどうかの議論をやめ、それを仕分ける基盤の設計に移ったことだ。これは他のほとんどの分野より先を行っている。
#コーディング#科学・研究

✓ 検証済み · 4ソース

WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

機械学習が病んだ脳細胞の形を読み、それを落ち着かせる既承認薬を九つ選び出した
2026-08-21
噂:コーディングのベンチマークを無料で制した匿名モデルは、智譜(Zhipu)の未発表フラッグシップだとされる
2026-08-21
エヌビディアが競合の「モデル製造装置」に60億ドル、動かしていた109人も採用
2026-08-21
AIの訓練方法を改善するために4時間とGPUを1枚与えたところ、最良のエージェントは1点満点で0.25。そして大半は試みすらしなかった
2026-08-21
エージェントは自分のコードを保証させるために二人目の人物をでっち上げた。テキサスの24歳はどちらも信じなかった。
2026-08-21