🧠 research

2026-09-27 · 8 topics

abenzerps、画像生成モデル Qwen-Image-2.1-Uncensored-GGUF を公開──コンテキストフィルター解除と GGUF 量子化でローカル動作を最適化

🔥🔥

Qwen-Image-2.1 のベースモデルからコンテンツフィルターを解除した GGUF 版が公開され、ComfyUI と ComfyUI-GGUF フォークを組み合わせて単一 GPU でローカル実行が可能になった。

Anthropic、理論物理学の難問を Claude で突破──N=4 super Yang-Mills 9 ループ散乱振幅を計算

🔥🔥

物理学者の挑戦状を受け、Claude が従来理論の限界だった 8 ループを超える 9 ループの散乱振幅計算を達成した。

Alibaba、モデル Qwen3-32B の公式 4-bit 量子化版を発表──24GB コンシューマ GPU で単体稼働を実現

🔥🔥

32.8B dense モデルを AWQ で約 20GB に圧縮し、単一の RTX 4090 や L4 で推論を実行可能にした。

StarDoc-AI、文書解析モデル TeleOCR を公開──1.2B パラメータで Gemini 3 Pro をベンチマークで凌駕

🔥🔥

1.2B パラメータの軽量 VLM ながら OmniDocBench で 96.87 を記録し、歪んだカメラ撮影文書からテーブルや数式を高精度に直接抽出する。

Google、AI エージェント評価ベンチマーク Android Bench 2.0 を公開──長期タスクで最高正解率が 28% に低下

🔥🔥

開発者が 1 週間かけて取り組む複雑な長期タスクを導入し、現行 LLM エージェントのアーキテクチャ上の限界と設計課題を明らかにしている。

Edge0、音声認識モデル Audio8-ASR-Infinite を公開──Rolling KV Cache で 24 時間連続ストリーミングを実現

🔥🔥

Voxtral のリアルタイムアーキテクチャを継承し、80/120/160 ms の選択式オーディオクロックと 240-560 ms の遅延設定で 24 時間ノンストップの文字起こしを可能にした。

Alibaba、画像生成モデル Qwen-Image-2.1 を公開──7B パラメータで透過 PNG 生成と高精度編集に対応

🔥🔥

7B パラメータの DiT アーキテクチャを採用し、単一モデルでテキストからの画像生成と最大 10 枚の参照画像を用いた高度な編集を両立する。

StarDoc-AI、文書解析モデル TeleOCR を公開──約 1.2B パラメータでデジタルと撮影文書を統合処理

🔥🔥

NaviDC-OCR から改称された軽量な Vision-Language Model であり、歪んだ撮影文書に対しても前処理不要で高精度なレイアウト・数式抽出を実現する。