タグ
#deepmind
ニュースから
ニュース · 2026-10-06
EmbeddingGemma 2はテキスト、画像、音声、動画を端末内の768次元に統合する
Googleは、テキスト、コード、画像、音声、動画を共通のベクトル空間へ写像する7億4,000万パラメータの公開モデルEmbeddingGemma 2をリリースした。端末内検索では、benchmark首位よりも構成を選べるメモリ使用量とApache 2.0ライセンスの方が重要だ。
読む →ニュース · 2026-10-05
textGrain、長文では検出率95%でも25%の編集で17%に低下
OpenAIはEUの対象となるChatGPTとCodexの出力に、見えないwatermarkのtextGrainを導入する。400 tokenの文章では、単語の25%を類義語に置き換えると検出率が約92%から17%へ落ちたため、この印は主に編集の少ない文章の出所確認に向く。
読む →ニュース · 2026-09-30
Gemini 4 Argon、出力上限を100万tokenへ拡大するもAPIは未公開
GoogleはGemini 4 Argonを発表し、出力上限を従来の6万4,000から100万tokenへ拡大した。大規模な社内プロジェクトでの利用例も示したが、開発者はまだ自分で検証できず、印象的な実演と導入可能な製品の間には距離がある。
読む →ニュース · 2026-09-30
Google、cyber guardrailsを外したGemini 4 Argonを審査済み防御者に限定
Gemini 4 ArgonはまずFairwind Programを通じて選ばれたcyber防御者に提供され、Googleはcyber guardrailsを外した版を渡す方針だ。限定公開は安全性の試験であると同時に、最も強い能力を誰が使えるかを供給者が決める新たな権限も示している。
読む →ニュース · 2026-09-29
AIラボ関係者12人が危険を警告、それでも共通の処方箋はない
Palisade Researchは、OpenAI、Google DeepMind、Anthropicの現職または元関係者12人へのインタビューを公開した。証言は業界内部の現実的な対立を示す一方、主催者自身が選抜の偏りと共通解の欠如を認めている。
読む →ニュース · 2026-09-24
Gemini 3.8 Liveが97言語で話す顔を得た
GoogleはGemini 3.8 Liveに、音声、表情、リップシンクを97言語でストリーミングするアバターを追加した。Gemini Enterpriseで利用できるが、独自アバターの作成にはallowlistingが必要だ。
読む →ニュース · 2026-07-13
Google、Geminiをインドのテクノロジーラボのメンターに
AIを学校に導入しようとする試みの多くは、孤立したパイロットプログラムに終わります。Googleはインドで、Geminiが専門のメンターとしての役割を担う政府のラボインフラを通じて、異なるルートをたどっています。
読む →ニュース · 2026-09-23
Gemini 3.8はTTSを音声一覧から演技演出へ変える
Googleは、promptによる声の作成、台詞ごとの演出、100超の言語への対応を備えたGemini 3.8 Flash TTSとFlash-Lite TTSを発表した。重要な変化は自然さだけでなく、演技を制御し再現できる点にある。
読む →ニュース · 2026-09-15
Gemini 3.8 LiveにExtended Thinkingが追加。会話中にバックグラウンドでコンテキストを保持
Googleは、高速な会話とツールを使用した長時間の思考を分離する新しいExtended Thinking機能を備えたGemini 3.8 Liveをリリースしました。音声AIユーザーにとって、これは実行中のプロセスに割り込んで話しかけた際にタスクが中断する問題の終焉を意味します。
読む →ニュース · 2026-09-15
Google、OpenAI、Anthropicは、新政権が加速を求める中、密かにゲームのルールを調整していた
OpenAIは、次期トランプ政権が安全性の懸念を一蹴し、中国とのペースを維持するよう推進する中、AnthropicおよびGoogle DeepMindとの数週間にわたるAIの安全性に関する協議を確認しました。市場は、これが安全協定なのか、それとも小規模な競合他社を締め出すための手段なのかを見極めようとしています。
読む →ニュース · 2026-09-14
ビッグテックカルテルは現実なのか?AI開発の減速が疑問を投げかける
The Vergeは、最大手のテクノロジー企業における人工知能開発の最近の減速を分析しています。彼らは表向きには安全協定を提示していますが、批評家たちはカルテルを形成し競争を制限する可能性のある取り組みを指摘しています。
読む →ニュース · 2026-09-08
Google AlphaGenome Atlas:新しい医学時代のゲノム百科事典
DeepMind は、ヒトゲノムで考えられる 90 億の突然変異すべての影響を予測できるツールを発表しました。
読む →ニュース · 2026-08-13
Google、Gemini 3.7 Flashを発表:価格は半額、エージェント機能に注力
前バージョンから3週間後、GoogleはGemini 3.7 Flashモデルをリリースしました。出力トークンの価格が半額になり、自律的なタスク管理が大幅に改善されています。
読む →ニュース · 2026-09-02
Gemini 3.8 Flashは、一般ユーザー向けではないCyberバリアントを展開する
GoogleはGemini 3.8 Flashおよび3.8 Flash Cyberモデルを導入しました。基本のFlashは汎用エージェントを最適化しますが、Cyberバージョンはセキュリティオペレーションのための専門的なトラックとして分岐しています。これは、すべての目的に適合する単一のモデルが、エンタープライズ部門において限界に達し始めていることを示しています。
読む →ニュース · 2026-09-03
GoogleがWeatherNext 3を発表。リアルタイム衛星データによりAI気象モデルがより高精度に
Googleは、最新のAI気象予測モデル「WeatherNext 3」の提供を開始しました。物理シミュレーションではなく、リアルタイムの衛星データを分析することで、1時間ごとの更新で5キロメートル四方の精度まで予測を絞り込みます。
読む →ニュース · 2026-09-01
Geminiがビデオ全体を自律的にスキャン可能に:エージェント型アプローチでトークンとコストを削減
Googleは、Gemini Flashモデルに、すべてのフレームを一度に送信することなく、エージェントとしてビデオを動的にスキャンする機能を追加しました。これにより、画像理解の精度が向上するだけでなく、トークンの消費量と全体的なコストが大幅に削減されます。
読む →ニュース · 2026-08-17
不可視の電子透かしはテキストの真正性を証明するものではなく、AI法を遵守するだけだ
Anthropicは、Google DeepMindのSynthID-TextテクノロジーをClaudeのテキストに適用している。顧客のコストに影響を与えたり、テキストを混乱させたりすることはないが、文章を変更すると確実に信号が破壊される。
読む →ニュース · 2026-08-21
Google DeepMind、人間のようにゲームをプレイするAI「SIMA 2」を発表
Atariのゲーム攻略から15年、DeepMindがSIMA 2を発表。ゲームのAPIを使用するのではなく、画面のピクセルを読み取り、自然言語の指示に基づいてキーを操作します。
読む →ニュース · 2026-08-27
Gemini Omni 1.1 Flashは、生成された動画に対する実際の制御を開発者に提供します
Googleは、動画APIを備えたGemini Omni 1.1 Flashをリリースしました。ランダムなクリップの代わりに、シームレスなシーンの拡張を可能にし、360pでのプロトタイピングを高速化します。
読む →ニュース · 2026-08-26
Gemini 3.5 Transcribe、生音声を直接フォーマットされたテキストに変換
Googleは、単なる文字起こしではなく、フィラーワードを直接クリーンアップし、コンテキストを理解できるGemini 3.5 Transcribeモデルを発表しました。開発者はストリーミングと録音ファイルの両方で導入できます。
読む →ニュース · 2026-08-22
スタートアップInherentのエージェントが、10分の1のサイズのモデルで研究の複製においてClaudeとGPTを上回りました
イギリスのスタートアップInherentは、科学研究の結果を独立して複製できるFaradayエージェントを披露しました。AnthropicとOpenAIは、同様のタスクに最大のフロンティアシステムであるOpusとGPT-5.5を使用していますが、Faradayはわずか270億パラメータの特殊なQwen 3.6モデルでそれらを上回りました。
読む →