OpenAIは、まだ公開していない最先端モデルが解いたとする数学の長年の未解決問題の解答を、722本の論文原稿としてまとめて公開した。原稿はGitHubで公開されている。OpenAIが数学分野の成果をまとめて発表するのは今回が初めてではない。CEOのサム・アルトマン氏はXで「発見の新しい時代に入りつつある」と投稿している。
論文が1本ずつではなく、まとめて世に出る時代に入った。
OpenAIが未発表モデルで数学の未解決問題を解いたとする論文722本を一挙公開し、AIによる科学的発見の加速が鮮明になった。モリック教授は既存文献の再評価と発見の高速化という2つの革命を予測する一方、ショレ氏は答えを検証できる数学やコード以外では性能が頭打ちになる可能性を指摘する。AnthropicのGlasswingやChatGPT for Teensへの厳しい評価など、強力な能力を誰にどう渡すかという課題も浮上している。
OpenAIは、まだ公開していない最先端モデルが解いたとする数学の長年の未解決問題の解答を、722本の論文原稿としてまとめて公開した。原稿はGitHubで公開されている。OpenAIが数学分野の成果をまとめて発表するのは今回が初めてではない。CEOのサム・アルトマン氏はXで「発見の新しい時代に入りつつある」と投稿している。
論文が1本ずつではなく、まとめて世に出る時代に入った。
子ども向けの安全性を重視してアプリやサービスを評価している米国の非営利団体Common Sense Mediaは、OpenAIの10代向けサービス「ChatGPT for Teens」を「許容できないリスク(unacceptable risk)」と評価した。同団体の評価は、保護者がアプリやコンテンツを選ぶときの目安として広く使われている。
10代向けに作られた版にこそ、最も厳しい評価がついた。
Anthropicは、審査を通ったサイバーセキュリティ専門家が同社の高度なAIモデルを試せるプログラムを拡大すると発表した。このプログラム「Glasswing」では、これまでに12万9000件の脆弱性が見つかっている。
攻撃にも防御にも使える能力を、相手を選んで渡すという配り方だ。
AIが書いた低品質な文章があふれる中で、人間の著者が書いた本であることを示す「オーガニック文学(organic literature)」という新しい認証マークが登場した。読者は本を選ぶときに、このマークで人間が書いた本かどうかを見分けられる。
「人間製」が、無農薬野菜と同じ売り文句になった。
Keras作者のフランソワ・ショレ氏はXで、AIの得意・不得意が分野ごとに大きくばらつく現象(jagged frontier)について問題提起した。数学とコードは、答えを自動で検証できる強化学習(RLVR)でいくらでも伸ばせる。一方、それ以外の分野は人間が作ったデータが足りずに頭打ちになる可能性がある、という見方だ。答えを検証できない分野も性能は上がり続けているが、ペースは遅いと同氏は指摘する。その伸びが汎用的な能力の向上によるものか、学習データに新しい人間のデータが加わり続けているだけなのかは、まだ分からないとした。
伸びる分野と伸びない分野の境目は、答え合わせができるかどうかにある。
ペンシルベニア大学ウォートン校のイーサン・モリック教授はXで、AIが粗雑な論文を量産して研究機関の信頼を損なう時期はすぐに終わり、AIが2つの革命を起こしそうだと述べた。1つ目は、これまでに発表されたすべての文献が、人間の科学者が想定しなかった方法で読み直され、評価し直されること。2つ目は、新しい発見が速いペースで出てくるようになることだ。
未来の発見と同じくらい、過去の論文の読み直しに重みを置いている。