🧠 research

2026-09-26 · 8 topics

OpenAI と Anthropic の LLM、暗号解読ベンチマークで Enigma の未解読メッセージを解読──2005 年以来の難問を数日で解決

🔥🔥

OpenAI の Astra と Anthropic の Claude Opus 5 が歴史的な Enigma の未解読メッセージ 2 件を復号し、人間なら数か月かかる調査を数日で完遂した。

Zed、コーディングエージェント Delta のベンチマーク結果を公開──Codex と Claude Code に匹敵する精度を達成

🔥🔥

Terminal-Bench 2.1 を用いた 4 つのフロンティアモデルの比較で、Delta はコストとタスク完了率でネイティブハーネスと同等以上の性能を示した。

Moondream、音声認識モデル Parakeet Redux を公開──3 値量子化によりモデルサイズを 178 MB に圧縮

🔥🔥

NVIDIA 製 ASR モデルのエンコーダー重みを -1, 0, +1 の 3 値量子化に変換し、CPU や Apple Silicon 上での軽量かつ高速なローカル音声を実現した。

Together AI、判定・ルーティング特化モデル Tev1-4B-experimental を公開──約 17 ドルで学習可能

🔥🔥

Qwen3.5-4B をベースにした 40 億パラメータの判定モデルで、LoRA SFT による約 25 分の訓練と $0.042/100万トークンの安価なサーバーレス推論を実現。

Fastino、340M パラメータの構造化分類モデル GLiNER2.5-Decide を公開──1B 級モデルを凌駕するエージェントルーティング性能

🔥🔥

DeBERTa-v3-large をベースにした 340M のオープンウェイト分類器で、17 ドメイン平均で 60.1% の精度を記録し 4B 級ベースラインを上回った。

Google、音声生成モデル Gemini 3.8 Flash TTS を公開──ゼロからの声作成と 130 言語対応を実現

🔥🔥

自然言語の指示で新しい声をゼロから構築でき、音声デザインベンチマークで 1 位を獲得した長尺・対話対応 TTS モデル。

Ornith チーム、推論モデル Ornith-1.5-9B を公開──9B パラメータで 35B 級を超える性能を実現

🔥🔥

Qwen3.5 および Gemma4 ベースの 9B 密結合モデルとして、NVIDIA の NVFP4 量子化と自己改善強化学習ループを採用し、単一 GPU での高度な推論とコーディングを可能にする。

Naver、疎表現エンコーダーモデル splade-cocondenser-selfdistil が HuggingFace で 87.8 万ダウンロードを突破

🔥🔥

BERT語彙に基づく30,522次元の重み付き疎ベクトルを出力し、MS MARCO devでBM25の約2倍となるMRR@10 37.6を記録したセマンティック検索モデル。