🛠 tools

2026-08-04 · 8 topics

Baseten、推論最適化解説 Masterclass を公開──KV キャッシュやプレフィル分散による 10 倍高速化の手法

🔥🔥🔥

Baseten の Philip Kiely 氏らが、20 万トークン級の長文脈入力に対するキャッシュアウェア・ルーティングや量子化誤差の相殺といった推論最適化の深層を解説した。

ブログ記事、オープンソース開発ツールに関する考察──AI エージェントによるパーソナライゼーションの必然性

🔥🔥

AI エージェントがソースコードの変更と upstream 同期を自動化することで、複雑な拡張 API を持たないソフトでも 1 プロンプトでカスタマイズできる新時代を解説する。

JFrog、偽の SQLite 脆弱性アドバイザリ検出ツール調査──LLM 生成の架空 CVE が NVD 登録された問題の実態

🔥🔥

GitHub で公開された 50 件超の SQLite 向け偽 CVE を JFrog が検証し、存在しない関数や行番号を指摘する LLM スロップの深刻な脆弱性データベース汚染を暴いた。

個人ブログ、LLM 活用におけるドメイン知識の重要性を解説──Terence Tao 氏の対話を例にプロンプト技術の限界を指摘

🔥🔥

LLM を単なる一般化ツールとして使うのではなく、深いドメイン知識を持つ人間こそがモデルから圧倒的な成果を引き出せる点を実例で示した。

Rust コアチーム、言語仕様拡張提案 Move および Forget トレイトを公開──Pin の課題解決と非移動・デストラクタ保証を実現

🔥🔥

Rust の型システムを拡張し、メモリアドレスの固定やデストラクタ実行の強制をオプトアウト可能なトレイトとして導入することで、複雑な Pin の抽象化や安全なスコープ付き非同期タスク生成を実現する。

推論サーバー airllm、70B モデルの単一 4GB GPU 実行を実現──量子化なしで VRAM 制限を突破

🔥🔥

量子化や蒸留を行わずに Llama 3 70B などを単一 4GB VRAM のカードで動かす推論ライブラリが、Kimi K3 や DeepSeek-V3 などの超巨大モデルに対応した。

Cloudflare、エージェント SDK @cloudflare/computer を公開──コンテナ不要の分散実行環境を提供

🔥🔥

各エージェントに仮想ファイルシステムと複数バックエンドを統合提供し、コンテナ依存のスケール限界を打破する。

Vercel、アプリ開発プラットフォーム API v2 を公開──AI エージェントによる自動生成からデプロイまでをプログラム制御

🔥🔥

Vercel が v0 API v2 パブリックベータを公開し、VM ベースのランタイムで GitHub や ZIP からのアプリ自動構築・デプロイを可能にした。