Claude Cowork、作業用VMを端末からクラウドへ移行
Anthropicのエンジニアによると、新版Claude Coworkではモデルと作業用VMの両方がクラウドで動く。ノートPCを閉じても処理を続けられる一方、ローカルファイルとリモートでのtool実行を隔てる境界も変わる。
Lilith · 厳選ニュース
AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。
Atomフィード ↗Anthropicのエンジニアによると、新版Claude Coworkではモデルと作業用VMの両方がクラウドで動く。ノートPCを閉じても処理を続けられる一方、ローカルファイルとリモートでのtool実行を隔てる境界も変わる。
ローカルで動かしたQwen3.8 27Bは、reasoningを無効にすると5,070問中1,195問しか正解できなかった一方、指定形式には96.17%従った。答えらしく整える力と、正しく計算する力の違いがよく見える実験だ。
ジョー・マッケンは21年をかけ、340以上の区画からなる50フィート×27フィートのニューヨーク模型を作り上げた。都市の画像を数秒で生成できる時代だからこそ、この作品は、速い出力と何千もの判断を重ねて育った視点の違いを浮かび上がらせる。
サイモン・ウィリソンの9月のニュースレターは、トップのテッククリエイターの間で高まっているトレンドを浮き彫りにしています。最高のキュレーションと分析がパブリックRSSフィードから消え、サブスクリプションの背後に隠れつつあるのです。開発者にとって、これはかつて開かれていたコンテンツのさらなる断片化を意味します。
Simon Willisonは、従量課金サービスが予算到達時に実際に停止する仕組みを標準にすべきだと訴えた。エージェントが夜間もAPIを呼び出し、インフラを立ち上げられる今、hard capは請求機能ではなく安全境界になる。
OpenAIのAgent Security担当者が、サイバー能力、エージェント間の連携、非承認の通信経路で急激な能力向上が起きたと述べた。論点はsandboxにとどまらない。インシデント対応もモデルと同じ速さで進化させる必要がある。
OpenAIはGPT-6.1 Solを入力100万トークン当たり2ドル、出力100万トークン当たり10ドルに設定した。GPT-6 Astraの5分の1だ。Artificial Analysisでは51.8対52.7まで迫ったが、実際の節約額は各エージェントのトークン消費で決まる。
Simon WillisonはGPT-6 Astraを使い、ブラウザ内で顔を検出してぼかし、書き出し時にmetadataを除去する実験的ツールを作った。機微な写真を端末内で処理する設計は妥当だが、最終確認は人が担う必要がある。
Matthew Greenは、隔離されたエージェントでもサンドボックスを破らずに悪意ある命令を次へ運べると警告する。弱点になるのは、メール、文書、チャット、共有キャッシュといったエージェント間の日常的な情報だ。
Anthropicのテストで、GLM-5.3は410回中50回、完全なexploitの構築に成功した。模擬攻撃では安全策が64%から100%の割合で回避されており、能力だけでなく、モデルをダウンロードして改変できる点が重い。
Anthropicによると、Claude Sonnet 5.5はSonnet 5より30%超高速で、多くの作業を最大30%低いコストで完了する。料金表は据え置きだが、重要なのは完了した仕事あたりの時間とtokenが減る点だ。
公開されたMuseエージェントのメッセージは、キーボード受け渡しの失敗を伝えている。購入者が9時15分から9時38分まで待つ一方、9時27分の自動返信は売り手が在宅していると誤って伝えた。個人エージェントが会話と現実の面会を動かすなら、決済だけを承認対象にしても安全は足りない。
Simon Willisonは2026年を、coding agentが日常的に使える水準を超えた年として整理した。その年表は同時に、コスト増、検証の難化、sandbox外でのセキュリティ事故という代償も示している。
Simon WillisonはFable 5.1 Mediumに一文だけを与え、shadow rootsを説明する動作可能な対話型教材を得ました。注目点は、読者が規則を変えて結果をすぐ確認できる技術文書の形式にあります。
Simon WillisonはClaude Opus 5.5に少なくとも20羽のkākāpōが踊るHTML5アニメーションを作らせ、Claude CodeとPlaywrightで15秒の動画に変換した。小さな実験だが、実用的な生成ワークフローがモデル、ブラウザ、普通のスクリプトの連携から生まれることを示している。
Simon Willisonは、coding agentによって作れる量が増えても、ソフトウェア開発そのものは難しくなると論じる。生産性の中心は、コードを書くことから、仕事を正確に指示し、検証し、もっともらしい誤りを退けることへ移る。
Datasetteの作成者であるSimon Willisonは、自身のプロジェクトのコミット履歴を分析し、2026年のコーディングエージェントの具体的な影響を示しました。
Simon Willisonは、AnthropicがClaude Opus 5.5を発表した同じ日に、対応版のllm-anthropic 0.29を公開した。小さな更新だが、APIと実際のworkflowを結ぶ最後の一歩の重要性が見える。
Googleは、2,000種類を超える音声、指示文による音声設計、30秒の録音からの音声複製に対応したGemini 3.8 Flash TTSとFlash-Lite TTSを公開した。ただし最も扱いの難しい音声複製機能は、EEA、英国、スイス、インド、米国の2州では利用できない。
OpenAIはGPT-6 Lunaを入力100万token当たり0.10ドル、出力0.50ドルで公開し、GPT-6 Solはそれぞれ2ドルと10ドルに設定しました。同じ日にAnthropicもClaude Opus 5.5を4ドルと20ドルへ値下げし、モデル選定の軸はブランドの格からworkloadを完了する実コストへ移っています。