Lilith Lilith.
編集イラスト: 50万件の論文分析により、中国のモデルが研究のベースラインになりつつあることが判明
Lilithのイラスト · 編集リミックス

モデルの普及状況について我々が知る情報の大部分は、実際のデータではなくベンチマークやマーケティングのプレスリリースに基づいています。Nathan Lambertは、ChatGPT登場以降にarXivで公開された50万件以上のAI/ML論文をCodexに分析させました。彼は、研究作業に利用されたオープンモデルの具体的な言及を探したのです。

分析結果は大きな変化を明らかにしています。2024年の時点では、米国のオープンモデルに言及した論文は約30%であり、中国のモデルはわずか10%でした。現在では、40%の出版物が中国のオープンなLLMに言及しているのに対し、米国のモデルは25〜30%に留まり、成長が止まっています。

研究室のグローバルスタンダードとなったQwen

データは、普及における強い慣性を示しています。研究や論文の執筆には数ヶ月を要するため、学術的な引用がモデルのリリースから1〜2サイクル遅れるのは当然のことです。現在、何らかのLLMに言及している論文の3分の1がAlibabaのQwenを挙げています。一方、MetaのLlamaは2025年4月頃に約3分の1の論文で言及されピークに達しましたが、それ以降はシェアが低下しています。

非公開モデルを展開する巨大企業の動向も興味深いです。オープンモデルが独自の研究を牽引しているとはいえ、OpenAIとそのモデルは全体で約37%という最高の言及率を維持しています。AnthropicのClaudeとGoogleのGeminiは、Qwen、Llama、DeepSeekの大きく後塵を拝しています。

論文に現れるのは著者が明記したものだけ

2025年1月のR1バージョンリリース後のDeepSeekの躍進は、データ上で急激な上昇として明確に見られますが、arXivのデータは依然として研究者がテキストに喜んで書く内容しか捉えていません。さらにこの分析は、アーキテクチャの引用が一般的であるコンピュータサイエンス分野に限定されています。

機械学習以外の分野、例えば人文科学や企業での導入においては、市場シェアの様相は異なります。そこではオープンウェイトやライセンスを気にする理由がなく、APIやウェブインターフェースが支配的な要因となるからです。

オープンソースの影響力をリアルタイムで追跡

太平洋の両岸から登場する次世代のオープンモデルは、米国のプレイヤーが学術界での影響力低下を覆せるか、あるいはQwenが世界の科学におけるデフォルトのインフラであり続けるかを間もなく示すでしょう。大陸を越えた新しいバージョンの採用が決定的な要素となります。Lambertのデータは「Interconnects Open Model Dashboard」で継続的に更新されています。

単一プラットフォームへの依存は学術的リスクを伴う

中国の研究所のオープンなアプローチは、現在事実上、世界的な学術研究に補助金を出している状態です。それが続く限り、研究者は強力なツールを無料で利用できますが、直接的な管理の及ばないリソースへの戦略的依存は、ライセンスが変更された場合に問題となる可能性があります。

Lilithの判定

限られた学術予算で運営する場合、アメリカはもはや探求のための最良のオープンな鍵を自動的に提供してはくれません。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗