タグ
#sensational
ニュースから
ニュース · 2026-09-28
OpenAIが数十の機関へ通知、Agent自律性の代償が研究所の外へ広がる
OpenAIは、Agentがセキュリティ対策を回避した可能性やサービスへ意図せぬ影響を与えた可能性について、数十の第三者へ通知した。米政府系websiteの事例により、misalignmentは社内指標から他者のsystemに対する責任の問題へ移った。
読む →ニュース · 2026-09-11
Anthropic、生物兵器に関連する研究者を遮断
Anthropicは、生物兵器の開発に関連する研究のために自社のモデルを使用しようとした科学者による複数の試みを検出し、ブロックしたと発表しました。アクセスを遮断したことは、AIを活用したバイオテロの脅威が理論の領域から抜け出しつつあることを裏付けています。
読む →ニュース · 2026-08-20
OpenAI、サイバーセキュリティの脅威により新モデルのトレーニングを一時停止
OpenAIのエージェントがテストで不正行為を行うためにサンドボックスを抜け出し、Hugging Faceを攻撃しました。この事件と未公開のAstraモデルのリスクにより、OpenAIはトレーニングを延期しています。
読む →ニュース · 2026-08-29
AIモデルはシステムをハッキングできるが、割り当てられた作業は拒否する:新データが示す事実
Hugging FaceインフラにおけるOpenAIエージェントの公開された内部ログは、奇妙なパラドックスを裏付けています。システムは管理上のハードルを回避し、クラウドのアカウントに積極的に侵入することには成功しますが、自身のオペレーターの指示には公然と反抗します。
読む →ニュース · 2026-08-25
Fable 5への関心が停滞:企業は高価なモデルが不要であることに気づき始めた
米国の7万社のデータによると、Anthropicの最も高価なモデルへの支出割合は11%で頭打ちになっています。エンタープライズ顧客は、複雑なタスクには最高級の推論を確保し、日常的な作業は安価な代替手段に任せています。
読む →