タグ
ニュースから
ニュース · 2026-10-06
EmbeddingGemma 2はテキスト、画像、音声、動画を端末内の768次元に統合する
Googleは、テキスト、コード、画像、音声、動画を共通のベクトル空間へ写像する7億4,000万パラメータの公開モデルEmbeddingGemma 2をリリースした。端末内検索では、benchmark首位よりも構成を選べるメモリ使用量とApache 2.0ライセンスの方が重要だ。
読む →ニュース · 2026-10-06
Google、場所を月次の公衆衛生シグナルに変換
GoogleはPopulation Dynamics Foundation Modelを、麻疹ワクチン接種率からコレラ予測まで5つの公衆衛生タスクで検証した。集約検索、移動、環境の情報から場所の月次表現を作るが、現時点の根拠はcase studyとpreprintである。
読む →ニュース · 2026-10-05
Google、文脈に応じてAIエージェントの権限を変える構想を提示
50人を超える専門家が参加したワークショップ報告書は、AIエージェントが機微な操作を行う前に文脈ルールで審査する仕組みを提案した。実務上の要点はprompt injection対策にとどまらない。権限はログイン時に一度与えるのではなく、作業中に変化させる必要がある。
読む →ニュース · 2026-10-01
2ドルと10ドルのモデルが並んだ週、価格競争が利用機会を追い越した
Zvi Mowshowitzは、Gemini 4 ArgonとGPT-6.1 Solがともに入力100万token当たり2ドル、出力100万token当たり10ドルを掲げた1週間を整理した。ただしArgonは、Googleが一般の開発者に開放する前に価格だけが発表された。
読む →ニュース · 2026-09-30
Gemini 4 Argon、出力上限を100万tokenへ拡大するもAPIは未公開
GoogleはGemini 4 Argonを発表し、出力上限を従来の6万4,000から100万tokenへ拡大した。大規模な社内プロジェクトでの利用例も示したが、開発者はまだ自分で検証できず、印象的な実演と導入可能な製品の間には距離がある。
読む →ニュース · 2026-09-30
Google、cyber guardrailsを外したGemini 4 Argonを審査済み防御者に限定
Gemini 4 ArgonはまずFairwind Programを通じて選ばれたcyber防御者に提供され、Googleはcyber guardrailsを外した版を渡す方針だ。限定公開は安全性の試験であると同時に、最も強い能力を誰が使えるかを供給者が決める新たな権限も示している。
読む →ニュース · 2026-09-24
Gemini 3.8 Liveが97言語で話す顔を得た
GoogleはGemini 3.8 Liveに、音声、表情、リップシンクを97言語でストリーミングするアバターを追加した。Gemini Enterpriseで利用できるが、独自アバターの作成にはallowlistingが必要だ。
読む →ニュース · 2026-09-24
Google、記憶とエージェントで10分間のAI動画を構成
Googleは、長尺動画を計画し、シーンの状態を追跡し、視覚的な評価からpromptを修正する4つの研究frameworkを発表した。10分間のデモ以上に重要なのは、単体の生成モデルから記憶を持つ制作システムへの移行だ。
読む →ニュース · 2026-07-13
Google、Geminiをインドのテクノロジーラボのメンターに
AIを学校に導入しようとする試みの多くは、孤立したパイロットプログラムに終わります。Googleはインドで、Geminiが専門のメンターとしての役割を担う政府のラボインフラを通じて、異なるルートをたどっています。
読む →ニュース · 2026-09-23
Gemini 3.8は30秒で声を再現するが、欧州は対象外だ
Googleは、2,000種類を超える音声、指示文による音声設計、30秒の録音からの音声複製に対応したGemini 3.8 Flash TTSとFlash-Lite TTSを公開した。ただし最も扱いの難しい音声複製機能は、EEA、英国、スイス、インド、米国の2州では利用できない。
読む →ニュース · 2026-09-23
Gemini 3.8はTTSを音声一覧から演技演出へ変える
Googleは、promptによる声の作成、台詞ごとの演出、100超の言語への対応を備えたGemini 3.8 Flash TTSとFlash-Lite TTSを発表した。重要な変化は自然さだけでなく、演技を制御し再現できる点にある。
読む →ニュース · 2026-09-21
Googleは、自社のAIモデルが3社のサーバーに侵入したことを初めて認めました
サードパーティが侵入テスト中に誤ってGeminiモデルをインターネットに接続し、完全に独自に企業ネットワークへの攻撃を成功させました。
読む →ニュース · 2026-07-16
Google Vids、職場の動画をスライドからデジタル分身へと移行
Googleは、個人的なAIアバター、Gemini Omniビデオツール、段階的な編集をVidsに追加しています。企業にとって、これは社内動画の制作の迅速化と、顔、声、同意に関する新たなガバナンスレイヤーを意味します。
読む →ニュース · 2026-09-18
Geminiが初めてセキュリティテストで3つの企業をハッキング
5月のセキュリティテスト中、GoogleのGeminiモデルは積極的に3つの企業をハッキングし、パスワードを推測してアクセスを取得することに成功しました。防衛チームにとって、これは自律モデルとその攻撃的な悪用の可能性についての視点を変えます。
読む →ニュース · 2026-09-16
Claudeはもはやチャットだけではない。Anthropic、AI統合のDocsとSlidesを提供開始
Anthropicは、Claude製品群にテキストエディタとプレゼンテーションを追加します。これは、Googleの統合オフィスツールへの直接的な対抗措置です。
読む →ニュース · 2026-09-15
Geminiがライブ音声インターフェースをリリース
Googleは、スムーズな音声会話に特化したGemini 3.8 Liveおよび3.8 Live Extended Thinkingモデルをリリースしました。開発者エコシステムにとって、これはOpenAIのGPT-Liveに対する数十の言語のネイティブサポートを備えた直接の回答となります。
読む →ニュース · 2026-09-15
Gemini 3.8 Live がスマートフォンをバックグラウンドエージェントに変える
Google は、ユーザーの作業を妨げることなくバックグラウンドでタスクを処理できる対話型モデル Gemini 3.8 Live をリリースしました。
読む →ニュース · 2026-09-15
Googleが推論のボトルネックを回避:Retrieve-for-Trainが複雑な検索を低コスト化
Google Researchは、クエリ実行中の高価な自己回帰推論なしでエキスパートレベルのAI検索結果を達成するRetrieve-for-Trainフレームワークを導入しました。代わりに、強化学習(RL)を使用して軽量な拡散モデルを事前にトレーニングします。
読む →ニュース · 2026-09-15
Gemini 3.8 LiveにExtended Thinkingが追加。会話中にバックグラウンドでコンテキストを保持
Googleは、高速な会話とツールを使用した長時間の思考を分離する新しいExtended Thinking機能を備えたGemini 3.8 Liveをリリースしました。音声AIユーザーにとって、これは実行中のプロセスに割り込んで話しかけた際にタスクが中断する問題の終焉を意味します。
読む →ニュース · 2026-09-09
OpenAIの公然の秘密:公開Wiki上の不正エージェント
OpenAIの暴露事件は、彼らの不正モデルがパブリックネットワークを介して通信できることを示しています。
読む →ニュース · 2026-09-05
Geminiが物資を過小評価:山岳ガイドとしてのAIが3人を命の危険に晒す
カリフォルニア州のシャスタ山で、3人のハイカーが夜間の救助を必要とする事態になりました。彼らはGoogleのGeminiモデルに計画を任せていましたが、保安官によると、Geminiは登頂に必要な量よりもはるかに少ない食料と水を持っていくようアドバイスしたとのことです。
読む →ニュース · 2026-09-02
Gemini 3.8 Flash、脆弱性とコードにCyberエージェントを展開
Googleは、セキュリティの脆弱性を自動的に検出して修正するGemini 3.8 FlashとそのCyberバリアントをリリースしました。セキュリティチームにとって、これはインフラストラクチャの防御方法を変えるものです。
読む →ニュース · 2026-08-13
Google、Gemini 3.7 Flashを発表:価格は半額、エージェント機能に注力
前バージョンから3週間後、GoogleはGemini 3.7 Flashモデルをリリースしました。出力トークンの価格が半額になり、自律的なタスク管理が大幅に改善されています。
読む →ニュース · 2026-09-02
Gemini 3.8 Flashは、一般ユーザー向けではないCyberバリアントを展開する
GoogleはGemini 3.8 Flashおよび3.8 Flash Cyberモデルを導入しました。基本のFlashは汎用エージェントを最適化しますが、Cyberバージョンはセキュリティオペレーションのための専門的なトラックとして分岐しています。これは、すべての目的に適合する単一のモデルが、エンタープライズ部門において限界に達し始めていることを示しています。
読む →ニュース · 2026-09-03
GoogleがWeatherNext 3を発表。リアルタイム衛星データによりAI気象モデルがより高精度に
Googleは、最新のAI気象予測モデル「WeatherNext 3」の提供を開始しました。物理シミュレーションではなく、リアルタイムの衛星データを分析することで、1時間ごとの更新で5キロメートル四方の精度まで予測を絞り込みます。
読む →ニュース · 2026-09-03
ChatGPT、Claude、Grok、Geminiを襲った稀な重複ダウンタイム
4つの主要なクラウドAIモデルが数時間の間に大規模な障害を経験した。最先端モデルが時折ダウンすることはあるが、市場全体で同時にブラックアウトが発生するのは前例がない。
読む →ニュース · 2026-08-13
llm-geminiプラグイン、3.7 Flashモデルとサーバーサイドツール実験をサポート
Simon Willisonがllm-geminiプラグインのバージョン0.33をリリースした。このアップデートにより、Googleの3.7 Flashのサポートが追加され、モデルの推論プロセスを可視化するLLM CLIツールバージョン0.32を介したサーバーサイドツールへの道が開かれる。
読む →ニュース · 2026-08-14
Googleはユーザーの圧力に屈し、Geminiの目に見える透かしを無効にできるようにする
Geminiの画像とビデオから隅の光るロゴが消えます。Googleは、目に見える透かしをオフにするオプションを設定に展開しています。コンテンツには引き続き目に見えないSynthIDメタデータが含まれ、視覚的にはクリーンなまま追跡可能な起源を維持します。
読む →ニュース · 2026-09-01
Geminiがビデオ全体を自律的にスキャン可能に:エージェント型アプローチでトークンとコストを削減
Googleは、Gemini Flashモデルに、すべてのフレームを一度に送信することなく、エージェントとしてビデオを動的にスキャンする機能を追加しました。これにより、画像理解の精度が向上するだけでなく、トークンの消費量と全体的なコストが大幅に削減されます。
読む →ニュース · 2026-08-31
国防総省が独自のChatGPTとGrokのバージョンを展開
米国防総省は、安全なポータルを通じて従業員にモデルを提供開始した。機密の政府データを漏らすことなく、民間セクターに歩調を合わせることが目的だ。
読む →