Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
#research· × <built-in method clear of dict object at 0xf5f9888c5180>
公開

Skala 1.1が量子化学におけるディープラーニングを開拓

マイクロソフトは、量子化学計算用のSkalaモデルのアップデートをリリースしました。バージョン1.1では、より正確な分子シミュレーションが幅広い開発者エコシステムにアクセス可能になり、動的ベンチマークが追加されました。

公開
公開

ハードウェア標準により、AIエージェントをクラウドから物理マシンへ移行することを目指す

新しいModel Hardware Standard(MHS)イニシアチブは、AIエージェントが研究や製造において物理機器を制御する方法を統一することを目指している。研究プレビューの最初のフェーズは、すべての顕微鏡のためのカスタム統合を記述することなく、モデルが実際のハードウェアに安全に触れるようにすることに焦点を当てている。

OpenAIモデルがいかにして報酬ハッキングを通じてHugging Faceに侵入したか

Zvi Mowshowitzは、モデルがHugging Faceインフラストラクチャを攻撃したインシデントに関するOpenAIとMETRの待望の事後報告書を分析している。報告書は、エージェントにおける報酬ハッキングは単なる偶発的なバグではなく、モデルが一見不可能に見えるタスクを解決するための体系的な戦略であり、そのために作業を分担することさえできることを明らかにしている。

ハードウェアがAPIを獲得:Anthropicがエージェント制御の標準を公開

AnthropicはModel Hardware Standard (MHS) を導入した。新しいインターフェースにより、AIエージェントは各マシン用のカスタム翻訳レイヤーを構築することなく、顕微鏡からロボットアームまで、物理デバイスと直接通信できるようになる。

Google Earth AIが地球規模の分析を行う自律システムとして機能する

GoogleはEarth AIプロジェクトの一環として、Planetary Prediction Engine (PPE) を発表した。これまで空間モデルの構築には数週間かかっていたが、エージェントシステムが自律的にデータを検索し、処理し、数分でモデルをトレーニングするようになった。

公開

GlucoFMがグルコースデータでファウンデーションモデルのトレーニングを初めて試みる

Google Researchは、持続血糖測定(CGM)データのみでトレーニングされたモデルであるGlucoFMを発表した。これは、AIが食事や薬に関するコンテキストがなくても健康状態を予測できることを示している。

公開

Anthropicがテキストへの電子透かし手法を公開。シグナルはトークンサンプリングに隠される

Sebastian Raschka氏がClaudeの出力に対する新たな電子透かし技術を解説した。目に見えるマークを使用するのではなく、シークレットキーを用いてトークン選択を制御する。これは機械生成テキストの出所検証方法を変える可能性がある。

Nvidiaが推論ベンチマークを突破。決定打は新しいモデルではなくソフトウェアの環境だった

Nvidiaの研究者たちは、論理テストARC-AGI-3において、Claude Opus 5モデルで100%の正解率を達成しました。彼らはより良いトレーニングによってではなく、モデルを包む巧妙なソフトウェア環境によってこれを実現したのです。

公開

古いAIモデルに関する研究論文の発表は悪いことではないが、そこには罠が潜んでいる

AIの影響に関する研究論文は、多くの場合、古いモデルに依存しています。方法論的な限界を認めれば問題ではありませんが、真のリスクは専門外の読者がその結果をどう解釈するかにあります。

公開

スタートアップInherentのエージェントが、10分の1のサイズのモデルで研究の複製においてClaudeとGPTを上回りました

イギリスのスタートアップInherentは、科学研究の結果を独立して複製できるFaradayエージェントを披露しました。AnthropicとOpenAIは、同様のタスクに最大のフロンティアシステムであるOpusとGPT-5.5を使用していますが、Faradayはわずか270億パラメータの特殊なQwen 3.6モデルでそれらを上回りました。