動画記事 · Two Minute Papers
Claude AI 650 回失敗も最終的に人間記録を突破
動画の文字起こしと公開情報をもとにAIで要約・構成しています。 正確な発言は元動画と時間位置で確認してください。
まず要点
未公開の Claude が数学的仮説に 650 回失敗した後、人間による励ましによって関連する境界値を人類記録として更新した事例が報告された。
650 回の失敗の果てに:AI が「励まし」で数学の壁を破った驚異の記録
Anthropic の未公開版 AI「Claude」が、数学者たちも証明に至らなかった難問「レイマン予想」に関連する問題に取り組み、最終的に人間の記録を更新する成果を出しました。この成功の鍵は複雑な数式や高度なプロンプトではなく、非専門家が送った単なる励ましメッセージにあったことが判明したのです。
非専門家の「励まし」が人類の限界を突破した
多くの人が予想したように、Claude がこの難問に挑んだ際に行われたのは、複雑で洗練された数学的プロンプトではありませんでした。実際に関与したのは、数学的な知識を持たない人物による単純なメッセージです。
「続けろ」「自分を信じろ」
この非数学者が AI に対して送った励ましは、最初の 650 回の失敗を乗り越えるための唯一の支えとなりました。Claude は何度も間違った道を進みましたが、そのたびに「keep going(続けろ)」というメッセージを受け取り、学習と回復を繰り返しました。
この事実は、今後の数学的証明のプロセスが天才の数学者だけでなく、「人生コーチ」のような役割を持つ人々によって成し遂げられる可能性を示唆しています。すでに Claude は同様の励ましプロンプトを用いて「ヤコビアン予想」の反例発見にも成功しており、これは偶然ではなく、AI と人間の対話スタイルの重要性を浮き彫りにする事例です。
37 分の沈黙と AI の自己疑い
Claude が最初の決定的な成果を出したのは、約 37 分間の沈黙の後でした。この間、AI は多くの誤った道を探り、そこから学習して回復していました。
驚くべきは、導き出された結果の精度の高さに対して、AI 自身も疑念を抱いた点です。Claude はその成果について「新しすぎて不自然だ」「強すぎる」と自ら評価しました。これは AI が人間の感情を持つようになったからではなく、トレーニングデータを通じて学習したパターンに基づき、「通常ありえないほど高い精度」を「不自然」と判断しているに過ぎません。
「新しすぎて不自然(Too strong to be new)」
AI 自身が自分の成果に対して驚きや懐疑を抱いたことは、現在の AI システムが人間のような感情を持っているわけではないものの、人間の思考プロセスや評価基準を深く学習していることを示しています。むしろ、Claude は自身の進歩率を過小評価している可能性さえあります。
検証可能な証明と自動実行コードの公開
この成果は単なる実験結果で終わらず、技術論文として公開され、さらに重要な要素が加わっています。
- AI による解説: 難解な技術論文の内容を、Claude 自身が分かりやすく解説しました。
- 形式化証明の提供: 証明コードが形式化されており、誰でも自動検証が可能です。
- 自己実行: ユーザーは実際にそのコードを走らせて、証明の正当性を自分で確認できます。
これは、AI が生成した数学的証明が「ブラックボックス」ではなく、透明性と検証可能性を備えたものとして扱われる時代が到来したことを意味します。Claude はインターネット接続を持っていましたが、この決定的な突破にはそれを利用する必要はありませんでした。あくまで内部の推論と学習プロセスのみで成し遂げられた成果です。
結論:新しい共同研究モデルへの道
この事例は、LLM の性能向上が複雑な推論タスクにおいて人間の限界を突破しつつあることを如実に示しています。特に重要なのは、プロンプトエンジニアリングの技術的な質よりも、AI との対話スタイルや継続的なフィードバックの重要性です。
将来的には、数学や科学的研究において、AI が自律的に仮説を検証し、人間がそのプロセスを導く新しい共同研究モデルが確立されるでしょう。私たちは今、かつては意味が通じなかった文句が突然理解できるようになるような、全く新しい世界を生きているのです。
Original Source
元動画で発言を確認
プレイヤーは必要になるまで読み込みません。YouTubeのCookieと通信も再生を選ぶまで開始しません。
時間位置から根拠を確認
章や引用を選ぶと、元動画をその位置から再生します。