🧠 research

2026-08-06 · 8 topics

Meta、コーディング特化モデル Muse Spark 1.2 と端末エージェント Muse Code を公開──大規模リポジトリでの自律タスク実行を最適化

🔥🔥

Meta が発表した Muse Code と Muse Spark 1.2 は、非同期バックグラウンドエージェントとローカルイベントログによるリプレイ安全性を備え、長時間の自律的なリポジトリ開発やカーネル最適化を実現する。

Mistral、安全性モデル Shieldstral を公開──3B パラメータで 20B 級を上回る F1 スコアを達成

🔥🔥

推論時に英語でポリシーを動的定義できる 3B のオープンウェイト安全性分類器。単一の 16GB GPU でマルチモーダル検閲を効率化する。

Google Creative Lab、音声翻訳アーキテクチャ Gemma Translator を公開──Raspberry Pi 5 で完全オフライン動作

🔥🔥

Raspberry Pi 5 と軽量モデルを組み合わせ、クラウド接続なしでリアルタイム音声翻訳を 80 ドル相当のハードウェアで実現した。

Google DeepMind、AGI から超知能に至る 4 つの経路と 6 つのボトルネックを公開──AI 進化の設計図を提示

🔥🔥

Google DeepMind の論文「From AGI to ASI」をベースに、汎用人工知能から超知能への移行における技術的経路と、物理世界での制約を詳解する。

Prime Intellect、推論特化エージェント Prime Agent を公開──ARC-AGI-3 で人間専門家超えの 95.5% を記録

🔥🔥

固定の枠組みを超えて実行中に自らプロンプトやメモリを書き換える Continual Harness により、専用学習なしで人間超えを達成した。

Apple、Diffusion Transformers の外れ値トークン制御手法 Dual-Stage Registers を発表

🔥🔥

Representation Autoencoder-DiT パイプラインにおける外れ値表現と局所パッチのセマンティクス破損を解消し、生成品質を安定させる手法を提案した。

Databricks、Unity AI Gateway を一般提供開始──エージェント制御とコスト最適化を単一基盤で統合

🔥🔥

Unity Catalog の拡張としてエージェントの動的制御や PII 監査を統合し、複数モデル利用における予測不能なコスト肥大を抑制する。

Artificial Analysis、推論劣化を暴く評価ベンチマークモデル Endpoint Accuracy Index を公開──API プロバイダ間の精度差を可視化

🔥🔥

プロバイダ側の量子化やトークン上限により、同一モデルでも API 経由では自社ホスト版の半分の性能に落ちるケースがある実態を数値化した。