2026-09-22 · 8 topics
Google、推論サーバー AX を公開──エージェント専用の宣言型オーケストレーターで数百万規模のタスクを制御
🔥🔥🔥ステートフルで待機時間が長いエージェントの特性に合わせ、0秒起動のサスペンド・レジュームと Kubernetes 統合を提供する。
Meta、AI アシスタントツール Muse に重大な 0-day 脆弱性──ローカルアプリからの悪用でアカウントが完全乗っ取り可能に
🔥🔥🔥Meta のセキュリティ特化型 AI アシスタント Muse において、ローカルアプリが認証トークンを奪取できる 0-day 脆弱性が発見され、Amazon がアクセスブロック措置に踏み切った。
convaiinnovations、判断モデル Laya を公開──単一フォワードパスで約 33 ms の高速判定
🔥🔥🔥テキストやJSONなどの状態を入力し、型付きの質問に対して数学的確率を伴う回答を約33msの単一フォワードパスで返す多言語非自己回帰型判断モデル。
jaredpalmer、決定木モデル群 Kev を公開──Qwen3.5 ベースで確率出力と 3 スケールに対応
🔥🔥Qwen3.5 をベースに確率出力や複数質問を単一リクエストで処理できる 0.8B/4B/9B の決定モデル群を公開した。
OSS ライブラリ jev-leftpad を公開──LLM 呼び出しによる文字列パディング実装
🔥🔥padStart() の代替としてモデルに選択肢を問うジョークパッケージが npm に登場し、最大 10 スペースまでの制限付きで動作する。
Cloudflare、推論サーバー Cloudflare Python Workers の一般提供を開始──2 年間のプレビューを経て正式稼働
🔥🔥2 年間のプレビュー期間を経て Cloudflare Python Workers が一般提供 (GA) となり、V8 ベースの workerd ランタイム上で Pyodide による WebAssembly 実行が正式にサポートされた。
NVIDIA、推論サーバー NVIDIA Dynamo-Triton 26.07 を公開──TensorRT マルチデバイス統合でマルチ GPU 処理を簡素化
🔥🔥TensorRT 11.0 と Dynamo-Triton 26.07 の連携により、単一の Triton モデルインスタンスで複数 GPU を協調動作させ、大規模モデルの推論レイテンシを大幅に短縮した。
Cognition、エージェント SDK Devin に xAI の Grok 4.7 を追加──巨大差分とバックエンド開発のトレードオフ
🔥🔥Grok 4.7 は 2.1 兆パラメータの基礎モデルをベースに複雑なバックエンド開発で強みを発揮する一方、過剰なスコープ拡大によりレビューコスト増加の懸念がある。