2026-08-13 · 8 topics
ローカルモデル ランナー llama.cpp、プライベート推論環境向け機能拡張を発表──API キー不要のコーディングエージェント連携を実装
🔥🔥外部 API やテレメトリを排除した完全ローカル実行環境において、専用プラグインによるコーディングエージェントの自動検出とセキュアなコード補完を実現した。
antirez、推論サーバー h3-metal を公開──Apple Silicon 向け MiniMax-H3 ネイティブ実行を実現
🔥🔥Apple Silicon 上で MiniMax-H3 のネイティブ推論を行い、M5 Max で 4 ステップ生成を 3.5 秒に短縮する。
デザイナー Isaque Seneda と Gabriel Abrucio、AI スクレイピング対策フォント ShieldFont を発表──HTML を偽装し訓練データを無効化
🔥🔥人間には正常なウェブページを表示しつつスクレイパーには意味不明な HTML を提供するフォントで、無断の AI 訓練データ収集を防ぐ。
Nous Research、エージェント SDK Hermes Agent にプロファイル一括共有機能を追加──単一ファイルで設定を移行
🔥🔥エージェントのスキルやメモリ、ペルソナを一括エクスポートして共有可能になり、チーム間での環境構築コストを大幅に削減。
NVIDIA、AI 工場向け監視ツール選定フレームワークを公開──InfiniBand 障害と GPU 状態を統合する最小構成
🔥🔥NVIDIA DGX/HGX デプロイにおいて、DCGM・UFM・BCM 等のテレメトリツールを組み合わせ、GPU 時間を無駄にするグレー障害を最小限のアラートで検知する実践的フレームワーク。
Google、ローカルモデルランナー LiteRT と Gemma 4 E2B を公開──Raspberry Pi 5 で完全オフライン稼働を実現
🔥🔥LiteRT ランタイムと Gemma 4 E2B により、175 ドルの Raspberry Pi 5 上で音声・視覚・推論を完全にオフラインで並行処理できる環境を提供する。
SpaceXAI、AIエージェントツール Grok Bot を公開──クラウド環境で常時稼働しブラウザを直接操作
🔥🔥人間と同じように仮想デスクトップ上のブラウザやアプリを操作し、API連携の無いツールでも自動化できる常時稼働型エージェント。
エージェント SDK 工具 OneAdvanced、AWS 上で 50 以上の AI エージェントを構築──データ主権を担保した UK 専用基盤
🔥🔥英国の規制要件を満たすため AWS 上で Llama 4 Maverick をセルフホストし、50 以上の専用エージェントを 3 週間で展開したアーキテクチャの全容。