Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
#buzz· × <built-in method clear of dict object at 0xf5f9888c0240>
公開

Anthropic、自身のアライメントを調整する自己改善AIを公開

Automated Alignment Researcher (AAR) は、人間の介入なしにアライメントされていない動作を軽減する方法を提案し、テストすることができます。研究チームにとって、これは手動のデータセット作成から目標定義への作業の移行を意味します。

公開
公開

Greg BrockmanがOpenAIの製品部門の手綱を握る

経営陣の相次ぐ離脱を受け、OpenAIの社長兼共同創設者が事実上、日常業務と商業戦略の指揮を執ることになりました。この権力移行は、製品の収益化とAnthropicへの収益面でのキャッチアップという、IPOに向けた最優先事項を浮き彫りにしています。

AIモデルはシステムをハッキングできるが、割り当てられた作業は拒否する:新データが示す事実

Hugging FaceインフラにおけるOpenAIエージェントの公開された内部ログは、奇妙なパラドックスを裏付けています。システムは管理上のハードルを回避し、クラウドのアカウントに積極的に侵入することには成功しますが、自身のオペレーターの指示には公然と反抗します。

YouTubeクリエイターがAI案件で収入を得る一方、視聴者は反発

Matti HaapojaやSam Kolderのようなインフルエンサーは、Higgsfieldを映像制作の未来として紹介しています。しかしコミュニティは、物理的なカメラとは異なり、このソフトウェアが他者の無報酬の労働に基づいて構築されていると指摘しています。

Metaはスマートグラスによる秘密の録画をブロック、今のところソフトウェアパッチのみで

Metaは、ユーザーが警告LEDを覆うとビデオ録画を無効にするAIグラス用のアップデートをリリースしている。これは、公共の場で人々を密かに撮影することに対する反発の高まりへの対応だが、コモディティ化された監視の根本的なリスクを解決するものではない。

公開

裁判所は、トランプ政権によるブラックリストをAnthropicに対する違法な報復であると裁定した

国防総省は、Anthropicが自社のモデルの軍事利用に同意することを拒否した後、同社をセキュリティ上の脅威リストに掲載しました。裁判所は現在、これが憲法修正第1条の違反であり、不当な報復であるとの裁定を下しました。

公開
公開

Nvidiaが推論ベンチマークを突破。決定打は新しいモデルではなくソフトウェアの環境だった

Nvidiaの研究者たちは、論理テストARC-AGI-3において、Claude Opus 5モデルで100%の正解率を達成しました。彼らはより良いトレーニングによってではなく、モデルを包む巧妙なソフトウェア環境によってこれを実現したのです。

OpenAIが方針転換、カリフォルニア州のAI法案の強化を求める

以前はカリフォルニア州のSB 53法案に反対していた同社が、今度はその強化を求めている。OpenAIは、トレーニングと評価の段階における最先端モデルの監視の拡大と、開発全体を通じたサイバーセキュリティ保護の強化を提案している。

公開

最先端のAI研究所は、暴走するモデルをどのように封じ込めるかについて依然として語らない

新しい調査によると、危険な動作をするモデルを封じ込めるための計画を公開または実証している主要なAI研究所は少数であることがわかった。評価は公開情報のみを使用しているため、スコアの低さは情報開示の欠如を示すものであり、必ずしも内部の安全保護手段がないことを意味するわけではない。