🧠 research

2026-08-16 · 6 topics

Sebastian Raschka、AI テキスト検出器構築学習レシピを公開──DistilBERT を用いたカスタム検出器の実装と RLVR 応用

🔥🔥

Substack の AI 検出機能の背景にある手法を参考に、データセット構築からモデル学習、ローカルデプロイまでを網羅した実装チュートリアルを公開した。

ByteDance、動画生成モデル Seedance 2.5 を公開──最大 30 秒の長尺生成と 50 件のマルチモーダル参照に対応

🔥🔥

Seedance 2.0 から生成時間を倍増し 50 件の参照入力を統合せしめる一方、Runway 上での出力解像度は 480p/720p に制限されるトレードオフを持つ。

Alibaba、オープンモデル Qwen3.8-27B-FP8 を公開──27B パラメータでネイティブマルチモーダルと推論制御を最適化

🔥🔥

27B のコンパクトな規模でありながらネイティブな視覚言語理解と柔軟な思考モード制御を備え、商用推論エンジンへの統合コストを大幅に引き下げた。

Meta Superintelligence Lab、推論特化 30B モデル Muse-Glimmer-30B-GGUF を公開──コンシューマ向けハードウェアでのエージェント自律実行に対応

🔥🔥

30B パラメータの因果言語モデルを GGUF 形式で量子化し、llama.cpp 上でローカル推論とマルチモーダル解析を実現する。

Z.ai、オープンモデル向けモデル GLM-5.3 を公開──サイバーセキュリティとエージェント型コーディングを強化

🔥🔥

743B パラメータの MoE 基盤を維持したままポストトレーニングを刷新し、IDOR 脆弱性検出で Claude Code を上回る推論能力を実現した。

LlamaIndex、構造化データ抽出ベンチマーク ExtractBench を HuggingFace で公開──370 業界文書と 5 軸タグで精度を評価

🔥

SEC 13F や医療レミッタンスなど 8 領域 370 ドキュメント(4,869 ページ)を網羅し、LLM の抽出エラーをタスク・長短の 5 軸で原因分解する。