🧠 research

2026-09-12 · 8 topics

Cerebras、モデル Qwen 3.8 27B を 1,850 トークン/秒で配信──ウェハースケール推論クラウドを活用

🔥🔥

Alibaba の Qwen 3.8 27B を Cerebras 推論クラウドで配信し、出力速度 1,850 トークン/秒と入力 $0.99/100万トークンの低価格を両立した。

Google、開発環境 Antigravity をアップデート──ゲノミクス研究スキルとマルチ日コードプロジェクト対応を追加

🔥🔥

1PB 規模の変異データベース連携と 3 階層エージェント推論を統合し、バイオ・大規模開発タスクの IDE 内完結を推進する。

Google Research、エージェントスキル進化フレームワーク WikiSkill を発表──プライベートノートブックの活用で精度を 15.0 ポイント向上

🔥🔥

エージェントの失敗履歴を非公開の wiki に蓄積してコーチの探索効率を高めることで、指示書ファイルを直接書き換える従来手法の限界を突破した。

VeriCache、出力精度を落とさず推論スループットを最大4倍に高める手法を提案

🔥🔥

圧縮KVキャッシュを下書きに使い非圧縮側で検証することで、長文デコード速度を最大2.73倍に引き上げた。

Apple ML Research、談話対応型手話翻訳モデル DiscoSign を発表──空間コアファレンスと QAC を LLM フレームワークで統合

🔥🔥

文単位の処理が主流だった手話翻訳に対し、空間一貫性や質問応答構造を考慮した初の体系的フレームワークを構築し、談話レベルの評価指標を提案した。

Apple、タンパク質設計アーキテクチャ SimpleDesign を公開──マルチモーダル 200 万件をデータ空間で直接学習

🔥🔥

アミノ酸配列と 3 次元構造を別個に圧縮せず単一ステージで同時最適化し、既存の多段階学習モデルと同等の性能を実証した。

WarmBloodAban、動画生成モデル Minimax-h3_Singularity を公開──HDR 画質向上と 4 ステップ高速推論に対応

🔥🔥

MiniMax-H3 をベースに 3 日間の重み最適化とプルーニングを行い、中遠景の顔面崩壊やモーションブラーを抑制した ComfyUI 向けファインチューンモデル。

Nex-AGI、1.6兆パラメータの MoE モデル Nex-N2.5 をオープンソース公開──視覚フィードバックによる長期エージェントタスクを強化

🔥🔥

mini、Pro、Max の3サイズで展開し、最上位の Max では1.6兆パラメータ規模の事後学習を初めて完遂した。