OpenAIが、未公開のAIモデルが書いた数学の論文722本を公開。成果は大きいが「まだ検証の途中」と本人たちも注記
・OpenAIが、社内の未公開のAIモデルが書いた数学の論文722本(372のまとまり)を、誰でも見られる公開の置き場(GitHub)に出した。数学と理論計算機科学の幅広い分野にまたがる
・モデルには約4,000の問題を出し、1つの成果あたり平均で約3時間、ChatGPT Proの「考える」計算を使ったと説明している
・OpenAI自身が「検証の段階はそれぞれ違う」「形式的に確かめていない成果には問題があるかもしれない」と注記。数学者からは、モデルが公開されて再現できるまでは慎重に見るべきだという声も出ている
OpenAIは2026年10月上旬、社内の未公開のAIモデルが書いた数学の論文722本を、公開しました。米メディアは10月6日に報じています。
AIが数学の問題を解いたというニュースは、ここ数か月で何度もありました(MetaのAIと数学者の論文の記事でも紹介しました)。今回の特徴は、その数の多さです。1つのモデルが、数百もの成果をまとめて出したことになります。
この記事では、OpenAIが公開した資料と報道で分かったことを整理したうえで、ふだんの仕事がどう変わるのかを考えます。
722本の論文を、372のまとまりに分けて公開した
まずは、何が公開されたのかを見ていきます。
OpenAIが公開した置き場(GitHubのリポジトリ)の説明によると、内容は次のとおりです。
| 項目 | 内容 |
|---|---|
| 公開したもの | 数学の論文722本と、証明を支える資料 |
| まとめ方 | 372のまとまり(ファミリー)に分け、数学の分野ごとに分類 |
| 書いたもの | 社内の未公開のAIモデル |
| 出した問題の数 | 約4,000 |
| 1つの成果あたりの計算 | 平均で約3時間分の、ChatGPT Proの「考える」計算 |
| 利用の条件 | Apache-2.0(誰でも使える公開の条件) |
既存の数学の試験ではモデルの成績が頭打ちになったため、評価の範囲を広げた、とも書かれています。
「検証の段階はそれぞれ違う」とOpenAI自身が注記している
次に、成果がどこまで確かなのかです。
公開資料では、次のように注記されています。
・成果ごとに、検証の段階が違う
・多くの論文には、証明をコンピューターで1行ずつ確かめる「Lean(リーン)」という仕組みでの検証が付いているが、すべてではない
・Leanで確かめていない成果には、問題がある可能性がある。見つかれば、速やかに直すよう努める
・直した場合は新しい版として出し、前の版も見られるようにしておく
報道によると、OpenAIの広報は、ほぼすべての成果が「1つのAIエージェントへの1つの指示」から生まれたと説明しています(米Scientific American)。一方で、米マサチューセッツ工科大学の数学者は、モデルが公開されて誰でも再現できるようになるまでは、こうした主張は確かめられていないものとして扱うべきだと話しています。
スポンサーリンク
仕事はどう変わるか:AIが「大量に出す」時代は、確かめる人の仕事が増える
ここからは、公開された資料と報道をもとにした僕の見方です。
今回のニュースで変わるのは、AIの成果に対する「確かめ方」の重みだと考えています。
AIは、人が何年もかけるような成果を、短い時間で、大量に出せるようになってきました。ところが、出てきたものが正しいかを確かめるのは、今も人の仕事です。722本の論文を、数学者が1本ずつ読んで確かめるには、膨大な時間がかかります。OpenAIが、コンピューターで証明を確かめるLeanを使っているのも、確かめる作業をできるだけ機械に任せるためです。
仕事でも同じことが起きます。AIに資料や企画を大量に作らせることはできても、どれが使えるかを見極める作業は残ります。
AIで大量の下書きを作れるようになった個人事業主ほど、「作る」より「選んで確かめる」ことに時間を使う働き方に変わっていきそうです。
あわせて、知っておきたいこともあります。
・成果を出したモデルは公開されておらず、誰でも試せるものではない
・OpenAI自身が、検証の段階は成果ごとに違い、問題がある可能性も認めている
・報道にある「1つの指示から生まれた」という説明は、OpenAIの広報の話で、外部からはまだ確かめられていない
まとめ:OpenAIが数学の論文722本を公開。AIが大量に出すほど、確かめる力が問われる
OpenAIは、未公開のAIモデルが書いた数学の論文722本を公開しました。OpenAI自身が、検証の段階は成果ごとに違うと注記しています。
AIが成果を大量に出せるようになるほど、その中から正しいものを選び、確かめる力が大切になっていくのが、いちばん大きな変化です。
仕事でAIを使うときも、「作らせる」と同じくらい「確かめる」時間を取っておくのがよさそうです。
出典
・OpenAI「openai/math」(GitHub) https://github.com/openai/math
・Scientific American「OpenAI unleashes hundreds more math results upon a field already in shock」 https://www.scientificamerican.com/article/openai-unleashes-hundreds-more-math-results-upon-a-field-already-in-shock/
