2026-09-27 · 8 topics
abenzerps、画像生成モデル Qwen-Image-2.1-Uncensored-GGUF を公開──コンテキストフィルター解除と GGUF 量子化でローカル動作を最適化
🔥🔥Qwen-Image-2.1 のベースモデルからコンテンツフィルターを解除した GGUF 版が公開され、ComfyUI と ComfyUI-GGUF フォークを組み合わせて単一 GPU でローカル実行が可能になった。
Anthropic、理論物理学の難問を Claude で突破──N=4 super Yang-Mills 9 ループ散乱振幅を計算
🔥🔥物理学者の挑戦状を受け、Claude が従来理論の限界だった 8 ループを超える 9 ループの散乱振幅計算を達成した。
Alibaba、モデル Qwen3-32B の公式 4-bit 量子化版を発表──24GB コンシューマ GPU で単体稼働を実現
🔥🔥32.8B dense モデルを AWQ で約 20GB に圧縮し、単一の RTX 4090 や L4 で推論を実行可能にした。
StarDoc-AI、文書解析モデル TeleOCR を公開──1.2B パラメータで Gemini 3 Pro をベンチマークで凌駕
🔥🔥1.2B パラメータの軽量 VLM ながら OmniDocBench で 96.87 を記録し、歪んだカメラ撮影文書からテーブルや数式を高精度に直接抽出する。
Google、AI エージェント評価ベンチマーク Android Bench 2.0 を公開──長期タスクで最高正解率が 28% に低下
🔥🔥開発者が 1 週間かけて取り組む複雑な長期タスクを導入し、現行 LLM エージェントのアーキテクチャ上の限界と設計課題を明らかにしている。
Edge0、音声認識モデル Audio8-ASR-Infinite を公開──Rolling KV Cache で 24 時間連続ストリーミングを実現
🔥🔥Voxtral のリアルタイムアーキテクチャを継承し、80/120/160 ms の選択式オーディオクロックと 240-560 ms の遅延設定で 24 時間ノンストップの文字起こしを可能にした。
Alibaba、画像生成モデル Qwen-Image-2.1 を公開──7B パラメータで透過 PNG 生成と高精度編集に対応
🔥🔥7B パラメータの DiT アーキテクチャを採用し、単一モデルでテキストからの画像生成と最大 10 枚の参照画像を用いた高度な編集を両立する。
StarDoc-AI、文書解析モデル TeleOCR を公開──約 1.2B パラメータでデジタルと撮影文書を統合処理
🔥🔥NaviDC-OCR から改称された軽量な Vision-Language Model であり、歪んだ撮影文書に対しても前処理不要で高精度なレイアウト・数式抽出を実現する。