2026-08-31 · 6 topics
仏大学病院、LLM診断支援の架空病名検証──研修医の 44% が存在しない疾患を信用
🔥🔥LLMのハルシネーションが医師の思考に影響する「代理ハルシネーション」を検証し、経験値による受容率の差を明らかに。
Exponential View、AI の再帰的自己改善の限界とオープンモデルの市場動向を分析──Toby Ord の論文と半導体開発の最新事例から検証
🔥🔥AI による再帰的自己改善は物理法則や実験サイクルに阻まれて無限には加速せず、同時に商用ワークロードではオープンウェイトモデルの導入が進む実態を分析した。
FastVideo、動画生成モデル FastVideo-FastH3-4-step-Preview-v1-VSA-DataFree を公開──4 回の Transformer 前方演算で同期オーディオ生成
🔥MiniMax H3 ベースのモデルをデータフリー DMD2 と 90% sparsity の VSA-H3 で蒸留し、4 ステップのテキスト・オーディオ同時生成を実現した。
Qwen、次世代アーキテクチャモデル Qwen3.8-Flash-Next-FP8 を公開──Hybrid Attention と N-gram Embedding で推論効率を最適化
🔥Qwen4 の基盤となる実験的プレビューモデルであり、ブロック単位のスパースアテンションと N-gram 埋め込みにより、1M トークン級の長文脈処理におけるレイテンシを大幅に削減する。
Specific-Labs、推論データセット Scaffold-CoT を公開──cot_structure と three_section ヘッダー構造を導入
🔥Inventory や Execution などの 3 セクション構造と自己修正メカニズムを網羅した推論データセットにより、モデルの論理トレース検証精度を向上させる。
Pipecat、音声エージェント特化モデル PhoneLLM Alpha 1 を公開──GPT-5.6 Terra 比 94% 削減のコストと低遅延を実現
🔥Nemotron 3 Nano をベースにした 3.5B アクティブパラメータの MoE モデルであり、音声対話に特化した PhoneBench v1 ベンチマークで同等以上の精度を達成した。