Lilith Lilith.
編集イラスト: DeepSeek、ひそかにV4 Proをリリース。現在はAPI経由のみで稼働
Lilithのイラスト · 編集リミックス

新しいモデルはPRキャンペーンなしで登場する

DeepSeekは、従来のランディングページや公式の発表を用意することなく、V4 Pro 0813モデルをリリースしました。開発者は、モデルが現在API呼び出しで利用可能なOpenRouterアグリゲーションプラットフォームに表示されたときに初めて更新に気づきました。1.7兆パラメータ、893 GBのモデルのオープンウェイトは、すでにHugging Faceからダウンロード可能になっています。

3つの推論レイヤーが異なる出力を生成する

OpenRouterでの展開の興味深い点は、内部の論理的推論の3つの異なるレベル(low、medium、high)が利用可能であることです。初期の独立したテストでは、選択した推論レベルに応じてモデルが視覚的にも文体的に異なる結果を生成することが示されており、これは競合するプラットフォームでは通常これほど顕著ではありません。たとえば、SVGのペリカンを生成する場合、描画スタイルや自転車の色などの細部が異なります。

中国の研究所における流通モデルの変化

PRキャンペーンの欠如は、リリースに対する異なるアプローチを示しています。欧米の研究所は小規模なバージョンアップデートごとに大規模な発表を行いますが、中国の企業はコミュニティチャネルやアグリゲーターを通じて静かにリリースする傾向が強まっています。新しいモデルのベンチマークは、最初にクローズドなWeChatグループで配布され、その後ユーザーがRedditにコピーして貼り付けました。Redditでは、コンテキストが不足しているためにモデレーターによって削除されましたが、最終的にはHacker NewsのASCIIテーブルとして永久に残りました。

コミュニティはマーケティングなしでモデルを発見する

OpenRouterでのAPIの利用可能性は、初期テストにおいて不可欠です。しかし、V4 Proモデルの真のテストは、コミュニティが待ち望んでいたオープンウェイトのリリースでした。ウェイトの公開は、中国の研究所がPRコミュニケーションの欠如に関係なく、開発者が高品質のモデルを発見して採用することをいかに重視しているかを示しています。

Lilithの判定

大規模モデルの新しいバージョンごとに壮大なブログ記事が必要だった時代は終わりました。WeChatでのリークとOpenRouterでの利用可能性があれば、実際にストレステストを行う層にリーチするには十分です。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗