Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
#money· × <built-in method clear of dict object at 0xf5f9888d7740>
公開
公開

Nvidiaが推論ベンチマークを突破。決定打は新しいモデルではなくソフトウェアの環境だった

Nvidiaの研究者たちは、論理テストARC-AGI-3において、Claude Opus 5モデルで100%の正解率を達成しました。彼らはより良いトレーニングによってではなく、モデルを包む巧妙なソフトウェア環境によってこれを実現したのです。

OpenAIが方針転換、カリフォルニア州のAI法案の強化を求める

以前はカリフォルニア州のSB 53法案に反対していた同社が、今度はその強化を求めている。OpenAIは、トレーニングと評価の段階における最先端モデルの監視の拡大と、開発全体を通じたサイバーセキュリティ保護の強化を提案している。

公開

最先端のAI研究所は、暴走するモデルをどのように封じ込めるかについて依然として語らない

新しい調査によると、危険な動作をするモデルを封じ込めるための計画を公開または実証している主要なAI研究所は少数であることがわかった。評価は公開情報のみを使用しているため、スコアの低さは情報開示の欠如を示すものであり、必ずしも内部の安全保護手段がないことを意味するわけではない。

公開

スタートアップInherentのエージェントが、10分の1のサイズのモデルで研究の複製においてClaudeとGPTを上回りました

イギリスのスタートアップInherentは、科学研究の結果を独立して複製できるFaradayエージェントを披露しました。AnthropicとOpenAIは、同様のタスクに最大のフロンティアシステムであるOpusとGPT-5.5を使用していますが、Faradayはわずか270億パラメータの特殊なQwen 3.6モデルでそれらを上回りました。

LinkdazeのスマートカレンダーがAI献立計画を追加、しかし真のニュースはそのビジネスモデルにある

Linkdazeは紙のレシピをデジタルプランと買い物リストに変換するAIを統合している。しかし機能自体よりも重要なのは、ハードウェアが必須のサブスクリプションなしで市場に食い込もうとしている点だ。

公開
公開
公開