2026-08-11 · ← ニュース
Anthropicの未公開モデルがリーマン予想の研究を前進させる
単一の証明に3100万トークン
Anthropicの未公開モデルのテスト中、数学の深い背景を持たない開発者が、リーマン予想(数学で最も古く複雑な問題の1つであり、100万ドルの賞金がかけられている)の証明を試みるようにモデルにプロンプトを与えました。モデルは1日半働き、60のサブエージェントのネットワークを調整しました。
この期間中に、650の異なる数学的概念をテストしました。60のエージェントのうち、2つが主要なアイデアを開発し、13がそれをサポートする資料を提供し、30が新しい道を見つけようとして失敗し、13が検証者として機能し、最後の2つが科学論文自体を執筆しました。結果はその後Leanシステムで形式化され、Anthropicの社内数学者によって確認されました。
ランダムな試みから組織化されたネットワークへ
科学研究は、モデルが賢い検索エンジンとして機能していた段階から、調整された研究室の段階へと移行しつつあります。Anthropicは1つの巨大なモデルを使用するのではなく、専門的なワーカーの構造全体を生成し管理させました。
研究機関や企業にとって、これは科学プロジェクトに必要なリソースの考え方を変えます。長年の高価な研究や何百時間もの人間の時間ではなく、3100万の出力トークンの請求書を支払い、週末にプロセスを実行するだけで済みます。
発見と検証の境界
モデルはリーマン予想が成り立つ下限を前進させましたが、まだ全体を解決していません。エージェントの計算能力は、既存の方法を組み合わせるだけでなく、完全に新しい、以前に説明されていない理論的枠組みが必要になった時点で限界に達します。
Leanの実際の統合が真の力を示す
決定的な要因は、より広範な数学界がこれらの証明にどう反応するかです。学術雑誌がエージェントによって書かれLeanを通じて形式化された論文であふれた場合、科学的発見の著作者が実際に何を意味するのかについての議論が起こるでしょう。
Lilithの判定
科学は単一の数学者の心の中の輝かしい閃きからクラウドの請求書へと移行しています。トークンの予算が大きいほど、仮説の境界を前進させます。
外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。
元の記事 ↗ ↗