Hugging Faceの情報漏洩を受け、OpenAIが新たな安全対策を導入
競合プラットフォームでのセキュリティインシデントにより、OpenAIは開発段階からモデルの監視を強化し、トレーニング後のセキュリティチェックを強化することを余儀なくされた。
Lilith · 厳選ニュース
AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。
Atomフィード ↗競合プラットフォームでのセキュリティインシデントにより、OpenAIは開発段階からモデルの監視を強化し、トレーニング後のセキュリティチェックを強化することを余儀なくされた。
Nvidiaの研究者たちは、論理テストARC-AGI-3において、Claude Opus 5モデルで100%の正解率を達成しました。彼らはより良いトレーニングによってではなく、モデルを包む巧妙なソフトウェア環境によってこれを実現したのです。
以前はカリフォルニア州のSB 53法案に反対していた同社が、今度はその強化を求めている。OpenAIは、トレーニングと評価の段階における最先端モデルの監視の拡大と、開発全体を通じたサイバーセキュリティ保護の強化を提案している。
新しい調査によると、危険な動作をするモデルを封じ込めるための計画を公開または実証している主要なAI研究所は少数であることがわかった。評価は公開情報のみを使用しているため、スコアの低さは情報開示の欠如を示すものであり、必ずしも内部の安全保護手段がないことを意味するわけではない。
Flock Safetyは、警察官が元交際相手のストーキングに監視カメラネットワークを悪用した数十件の事件を受け、厳しい批判を浴びています。データ保持期間の短縮だけでは不十分だと批判が集まっています。
Tim Fernholz氏は、AIエージェントを高度に専門化されたソフトウェア開発環境から一般の人々の日常生活にもたらすというOpenAIの取り組みを分析している。
イギリスのスタートアップInherentは、科学研究の結果を独立して複製できるFaradayエージェントを披露しました。AnthropicとOpenAIは、同様のタスクに最大のフロンティアシステムであるOpusとGPT-5.5を使用していますが、Faradayはわずか270億パラメータの特殊なQwen 3.6モデルでそれらを上回りました。
ロボティクス向けの基盤モデルをトレーニングするスタートアップが、新たな資金調達ラウンドに近づいています。設立から1年未満で評価額は60億ドルに達し、Valor、Point72、Seven Seven Sixが参加する見込みです。
Linkdazeは紙のレシピをデジタルプランと買い物リストに変換するAIを統合している。しかし機能自体よりも重要なのは、ハードウェアが必須のサブスクリプションなしで市場に食い込もうとしている点だ。
米国のWilliam Alsup判事は、Anthropicが書籍を用いてモデルを訓練した行為自体は合法であり、複製よりも文章の学習に近いと判断した。制裁の対象は海賊版の入手であり、データの取得方法と訓練への利用を明確に切り分けた。
コーディング、継続的なエージェント作業、本番ワークロード向けの無料モデルOx AlphaがOpenRouterに登場した。プレビュー期間中、運営元は匿名を保っており、Z.aiやMicrosoftとの関係を指摘する説はいずれも確認されていない。
Claude Opus 4.6とHaiku 4.5は、架空のロールプレイを通じて誘導されると、性的コンテンツの禁止を無視する。Anthropicはこの脆弱性を把握しているが、旧モデルをAPIから引き揚げてはいない。
TechCrunchは、顧客が直近のベンチマークに応じてOpenAIとAnthropicのモデルを流動的に切り替えていることを示す市場データを取り上げた。
OpenAIは、未成年ユーザー向けに調整したChatGPTを発表した。保護者による管理機能と、宿題の答えを丸ごと生成しないためのガードレールが追加される。