2026-09-12 · 8 topics
OpenAI、推論サーバー向け GPT-6 Astra 導入ガイドを公開──Codex の過剰なプロンプトとスカフォールドをスリム化
🔥🔥GPT-6 Astra の高精度化に伴い、旧来のモデル補正用プロンプトや冗長な AGENTS.md のルールを削減し、コンテキスト圧迫を防ぐ最適化手法を提示した。
Amazon Web Services、LLM ベンチマークツールを公開──Amazon Bedrock 上の OpenAI モデルの成果単価を検証
🔥🔥Amazon Bedrock 上の OpenAI モデル(GPT-5.6 シリーズ)と OpenAI API のコスト効率を、成果ベースのオープンソース評価ハーネスで比較検証した。
Cognition、エージェント SDK Fusion を Devin Desktop と CLI で公開──2 モデル連携でコーディングコストを最大 46% 削減
🔥🔥上位のリードモデルが計画とレビューを担い、低コストなサイドキックが作業を代行する 2 エージェント構成により、主要ベンチマークで品質を維持したまま推論費用を圧縮する。
TLDR AI、Agents API・Cognition SWE-2・Muse Shared Agents の最新動向を公開──AI エージェント関連機能の統合を速報
🔥🔥2026年9月11日配信の TLDR AI ダイジェストで、Agents API や SWE-2 などの最新エージェント機能およびカンファレンス情報を網羅した。
Together AI、ファインチューニング基盤を拡張──GLM-5.3 や DeepSeek-V4-Flash に対応しトレーニング価格を最大 70% 削減
🔥🔥GLM-5.3 や DeepSeek-V4-Flash などの最新オープンモデルに対応し、Expert LoRA やライブメトリクス監視機能を追加した。
dealignai、セキュリティ特化ウェイト改変モデル GLM-5.3-CYBERSECURITY-FP8 を公開──サイバー攻撃・ペネトレーションテスト向けに拒否応答を排除
🔥🔥zai-org/GLM-5.3(753B)をベースにサイバーセキュリティ領域の拒否応答を80%以上排除したFP8版ウェイト改変モデルで、実戦的なペネトレーションテストやマルウェア解析をローカルで効率的に実行可能にする。
Nex-AGI、エージェント特化モデル Nex-N2.5-mini を公開──PC操作とマルチモーダル統合を強化
🔥🔥実世界のエージェントタスクに特化した Nex-N2.5 ファミリーとして、mini から 1.6 兆パラメータの Max まで OSS で開放し、ビジョンを環境認識の主要インターフェースとして統合した。
NVIDIA、推論高速化モデル Qwen3.8-Flash-Next-NVFP4 を公開──NVFP4 量子化でディスクサイズを約 2.7 倍削減
🔥🔥Alibaba 製 Qwen3.8-Flash-Next をベースに NVIDIA Model Optimizer で量子化し、Blackwell 世代 GPU 向け vLLM 推論を最適化した。