Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
#simonwillison· × <built-in method clear of dict object at 0xf5f981427440>
公開

GitHubがLLM実験を終了。エージェントが助成されたトークンを使い果たす

GitHubは、開発者に様々なプロバイダーのモデルへの無料APIアクセスを提供するサービスであるGitHub Modelsをひっそりと終了させました。CI/CDループにおける自律的なコーディングエージェントは成功を収めすぎ、割り当てられた予算をすぐに使い果たしてしまいました。

公開

リポジトリとしてのSQLite:圧縮は履歴税を消去する

Simon Willison氏は、バージョン管理されたテキスト履歴をSQLite列に直接保存することをテストしました。すべての過去のバージョンを単一のJSON配列に結合し、Zstandardで圧縮することで、1,000回の反復のサイズが20MBから80KBに縮小されました。

公開

弱いモデルがより強力な兄弟モデルの隠された思考を漏洩させる

研究者たちは弱いモデルを悪用して、最も強力なモデルから隠された推論プロセスの痕跡を抽出した。これは、モデルの推論を暗号化されたブロックに隠す試みが今のところほとんど幻想であり、意図せず704件のプライバシー関連の記録を暴露していることを示している。

公開

Simon Willison、Codexを使用してデータベースに依存しないsqlite-utilsを構築

Simon Willisonは、alchemy-utilsのプロトタイプを構築することで、CodexとGPT-5.6 Sol Ultraの機能をテストしました。このツールは、人気のあるsqlite-utilsライブラリのAPIをSQLAlchemyに移植することを目的としており、最適化によりサンフランシスコの木のインポート時間を1時間から35秒に短縮しました。

公開

DeepSeek、ひそかにV4 Proをリリース。現在はAPI経由のみで稼働

中国のスタートアップDeepSeekが、公式なプレスリリースなしに新世代モデルV4 Proをリリースしました。1.7Tパラメータのモデルは現在、OpenRouterプラットフォーム上のAPI経由、およびHugging Face上のウェイトとして利用可能です。

llm-geminiプラグイン、3.7 Flashモデルとサーバーサイドツール実験をサポート

Simon Willisonがllm-geminiプラグインのバージョン0.33をリリースした。このアップデートにより、Googleの3.7 Flashのサポートが追加され、モデルの推論プロセスを可視化するLLM CLIツールバージョン0.32を介したサーバーサイドツールへの道が開かれる。

公開

AnthropicのCEO、大衆がAI企業を信用しない理由を認める

AnthropicのCEOであるDario Amodei氏は、AIに対する否定的なイメージはリスクに関する破滅的な警告によって引き起こされているという主張を拒否しました。彼によれば、これはハイテク部門全体に対する深い信頼の危機であり、より良いPRキャンペーンでは解決できず、実際の結果によってのみ解決できるとのことです。

ローカルモデルQwen 3.8が登場するも、デフォルト設定は考えすぎの傾向

AlibabaはApache 2ライセンスのもと、270億パラメータの新しいモデルをリリースしました。ノートパソコンで実行するのに理想的なサイズですが、デフォルト設定のため、些細なタスクでも著しく冗長になります。

公開

WebAssemblyとMP4レンダリングがバックエンドなしでブラウザで実行

ツールmarkdown-svg-rendererは、現在のブラウザがどれほどの処理能力を持つかを示しています。Simon Willison氏はアニメーションSVGを検出し、ローカルのWebAssemblyを使用してビデオを組み立てるMP4タブを追加しました。

希少本の注文に仕掛けられたAirTagがAIトレーニングのための破壊的なスキャンを明らかにした

404 Mediaのジャーナリストたちが匿名の大量書籍購入の謎を解明しました。彼らはAirTagを使用し、作品が不可逆的にデジタル化されるAmazonのトレーニング施設まで荷物を追跡しました。

公開

Qwen 3.8 27Bは巨大モデルに追いつくが、そのために極端な計算能力を消費する

Qwenファミリーの小さなオープンウェイトモデルは、GPT-5.6 Lunaと同じスコアを達成しました。しかし、推論モードでのトークンの大量消費を代償としており、足りないサイズを計算力という力技で補っています。

公開

生成AIがコードを安価にした結果、複雑怪奇なソフトウェアが生まれている

サイモン・ウィリソンは、AIコーディングアシスタントの隠れたコストを指摘する。新機能の実装が1週間から1時間に短縮されたことで、コードベースの理解しやすさを保っていた自然なハードルが失われている。

公開

バグの噂だけでAIはエクスプロイトを作成できる時代へ

最新のAIエージェントは、コードの脆弱性が公に議論されてからわずか数分でそれを発見し悪用できる。オープンソースプロジェクトにとって、これは従来の情報の非公開期間や遅いパッチリリースの終わりを意味する。

公開

Claude Code Auto Modeの脆弱性:安全メカニズムが自身のクリーンアップをブロック

AnthropicはClaude Codeに防御用の「Auto Mode」を導入したが、攻撃によりエージェント自身に牙をむく可能性がある。侵害が発生した場合、安全システムがモデルによるマルウェアの削除をブロックする。

公開