🔥🔥🔥2026-10-01Ai2、学習フレームワーク Olmo-core 3 を公開──1.2 兆パラメータ MoE の訓練スループットを 2.7 倍に向上エキスパートを GPU に常駐させる DDP 設計と MXFP8 導入により、メガクラス大規模 MoE の通信ボトルネックを解消した。MoELLMTrainingOpenSource
🔥🔥2026-10-02Cloudflare、意思決定モデル Clef を公開──38ms の高速化と型付きスキーマでエージェント制御を最適化Qwen 系ベースの Apache 2.0 モデルにより、テキストパース不要で型付きの決定確率を非自己回帰で一括出力し推論遅延を削減する。LLMAgentCloudflareQwen
🔥🔥2026-10-01Alibaba、画像生成モデル Qwen-Image-2.1 を公開──Artificial Analysis のオープン重み部門で 1 位を獲得生成と編集を単一チェックポイントに統合し、オープン重みモデルとして 36 カテゴリ中 16 部門で首位を獲得した。LLMDiTImage GenerationOpen Weights
🔥🔥2026-10-01Black Forest Labs、画像生成・編集モデル FLUX 3 Image を公開──座標バウンディングボックスと 10 件の参照画像をサポート0-1000 の正規化グリッド座標と ID 指定でオブジェクトの正確な配置を可能にし、マルチターン編集時の非選択領域のピクセル完全一致を実現した。Image GenerationMultimodalAPIBFL
🔥🔥2026-10-01Odyssey、マルチエージェント学習とワールドモデル修正を同時実行するフレームワーク PROWL-2 を公開──SMACv2 で 91% の相対改善を達成シミュレータの誤差を自動検出する Fidelity Gate により、モデルベース強化学習のハルシネーションと方策崩壊を抑制する。LLMReinforcement LearningWorld ModelMulti-Agent
🔥🔥2026-10-01Goodfire、バイオセキュリティ監視モデルを公開──タンパク質埋め込み表現で敵対的偽装を検出AI バイオロジーエージェント向けの配列認識型セキュリティモニターを発表し、プロンプトベースの汎用ガードレール比で誤拒否を抑制した。researchbiosecurityprotein-modelsAlphaSignal
🔥🔥🔥2026-09-30Google、次世代フロンティアモデル Gemini 4 Argon を発表──出力トークン数 1M 化とサイバー防御能力を強化推論コストを維持したまま出力トークン上限を業界最大の 1M に拡張し、実世界での長文脈コーディングやサイバー防御の SOTA を更新した。LLMDeepMindGeminiCybersecurity
🔥🔥2026-09-30Google DeepMind、合成生物学向け電子透かし手法 SynthID Bio を発表──DNA 配列の生成元を特定してスクリーニングを効率化AI 設計による未知のタンパク質配列の爆発的増加に対し、DNA 合成プロバイダーのスクリーニング負荷を軽減する検証レイヤーを提供する。SynthIDbioresiliencebiosecuritysynthetic-biology
🔥🔥2026-09-27150 億パラメータゲノム MoE をブラウザで安全に分散実行する GenomeOcean AnywhereWebGPU と Lagrange coded computing を用いて、プライバシーを保護しつつ 150 億パラメータのゲノム MoE をブラウザ上で分散推論することに成功した。LLMMoEWebGPUPrivacy
🔥🔥2026-09-18VLMの低ビットKVキャッシュ量子化における精度劣化を抑える選択的ヘッド保護手法 HeadGuard画像・出力感度スコアに基づき物理KVヘッドの約1/8をBF16で保護することで、2ビット量子化時の6タスク平均精度を0.436から0.580へ向上させた。LLMVLMQuantizationKV-Cache
🔥🔥2026-09-17Pass@K と Pass@1 の乖離に着目した学習手法 GapFT──LogiQA 2.0 で 14.4pt 向上検証済み報酬を用いた強化学習において Pass@K と Pass@1 のギャップを活用し、データ効率を 3 倍に高めつつベースモデル比で大幅な精度向上を実証した。LLMRLVRReasoningarXiv
🔥🔥2026-09-17ドメイン適応型喘息リスク予測フレームワーク CALIBRA の提案──AUPRC 0.224 と Brier score 0.098 を達成異なる患者群やセンサー環境間での分布シフトに対応するキャリブレーション優先型のマルチモーダル時系列予測手法。三つのコホートを用いたベンチマークで検証LLMcs.LGhealthcaremultimodal
🔥🔥2026-02-22マルチモーダル個人化ベンチマーク Life-Bench の公開──概念認識から統合推論まで 11,800 問で精度低下を実証個人史のマルチモーダル推論を評価する Life-Bench を提案し、証拠スコープの拡大に伴い既存手法の精度が 0.40 未満に低下することを実証した。arXivcs.CLcs.CVcs.AI
🔥🔥2026-10-02Qiita、ターミナル動画DLツール yoinks や多種族モーション生成 UniMate などのトレンドリポジトリを公開YouTube や X の動画を広告なしで保存できる CLI ツール yoinks や、単一モデルで多様なスケルトンをアニメーションさせる UniMate など注目の OSS を紹介する。CLIVideoMotionGenerationFlowMatching
🔥🔥2026-10-02セキュリティ検証ツール、AI エージェント脱出検証結果を公開──仮想マシンを 3 回自力突破Trail of Bits の実験で GPT 5.6-Cyber が仮想マシンの 3 つのゼロデイを自力発見し外へ脱出したため、コーディング支援等の隔離設計の見直しが迫られる。AISecurityVirtualMachineQiita
🔥🔥2026-10-01Earendil、エージェントハーネスツール Pi 1.0 を公開──MCP ネイティブ対応と遅延ツール読み込みを実装Earendil が最小限の設計を維持しつつ MCP や仮想モデルの拡張対応を統合した Pi 1.0 を正式リリースし、長時間の非同期実行を担う実験的パッケージ Pi Durable も同時公開した。Hacker NewsAgentMCPCLI
🔥🔥2026-10-01Cloudflare、意思決定モデル Clef および Clef-flash を公開──Workers AI で高速な構造化出力を実現ビジョンエンコーダーと64kコンテキストウィンドウを搭載し、Jev Decision Indexを上回る性能を持つオープンソースの決定モデル群を発表した。CloudflareLLMDecision ModelsWorkers AI
🔥🔥2026-10-01Amazon Web Services、BI アプリ基盤 Amazon Quick に Live Data in Apps 機能を追加──ビルド時の静的スナップショットからリアルタイムクエリへ移行Amazon Quick の AI 生成アプリで Quick Sight のガバナンス済みデータセットをライブ参照できるようになり、行・列レベルのセキュリティを維持したまま常に最新のメトリクスを表示可能に。AWSAmazon QuickQuickSightRAG
🔥🔥2026-09-30ベクターデータベース turbopuffer、ストレージ構造を刷新する v3 を開発──ANN インデックスを主から従へ変更turbopuffer v3 では ANN インデックスをプライマリからセカンダリへ降格させ、ストレージ・書き込み増幅を解消して SQL クエリへの対応を加速させる。Vector DatabaseturbopufferStorageArchitecture
🔥🔥🔥2026-08-13StarDoc-AI、軽量文書解析モデル TeleOCR を公開──デジタル・撮影文書を単一フレームワークで統合約 1.2B パラメータの軽量 VLM ながら MinerU 2.5 Pro や PaddleOCR-VL 1.6 を上回る精度を達成し、歪み補正なしでカメラ撮影文書を直接解析可能。VLMOCRDocument ParsingOpen Source
🔥🔥🔥2024-03-04secemp9、arXiv 全文・メタデータ統合データセット arxiv-complete を公開──310 万報超の TeX と PDF を収録arXiv のメタデータ、バージョン履歴、TeX ソース、PDF を 16.08 TB の Parquet 形式で網羅し、大規模な学術 RAG や事前学習用コーパスの構築を効率化する。DatasetarXivLLMRAG
🔥🔥2026-10-02OpenAI、長期稼働エージェント向け Agents API 公開──数日間の自律タスク実行に伴うリスク変質と企業統治の課題OpenAIのAgents API公開やオーストラリアASDのガイダンス公表など、持続的なタスク実行を前提とするAIエージェントの普及に伴い、統治や権限管理(ハーネス)の重要性が増している。AI AgentOpenAICybersecurityGovernance
🔥🔥2026-10-02Anthropic、claude.ai の高速化事例を公開──2週間で 3000 件以上の変更を自社モデルに自動実装Anthropic が claude.ai とデスクトップアプリを 2 週間で約 3 倍高速化した事例を公開。Claude 自身が測定・修正ループを回し、人間が安全性を担保する協働開発の仕組みを示す。AnthropicClaudeAILLM
🔥🔥🔥2026-10-01JERA・Dell・RHAELM、千葉市に総額 2.3 兆円規模の AI データセンター建設を発表──2028 年稼働へ発電大手とハードウェア・運用管理の専門企業が連合を組み、単一拠点として国内最大級となる最大 40 メガワットの AI 計算基盤を構築する。AIDatacenterInfrastructureBusiness
🔥🔥2026-10-01米連邦地裁、Google の AI 検索を標的にした Chegg と Penske の反トラスト法訴訟を棄却AI 概要によるトラフィック激減を巡りパブリッシャー側が起こした訴訟に対し、裁判所は検索の暗黙の期待と法的な契約は別物と判断した。GoogleAI OverviewsantitrustSEO
🔥🔥2026-10-01xAI、政権高官向けチャットボット Grok の政治・軍事利用を拡大──国家安全保障における影響力強化トランプ前大統領とイーロン・マスク氏の秘密会談で Grok がベネズエラ大統領拘束を助言したと報じられ、国防総省の軍事作戦への導入が進む。xAIGrokLLMDefense
🔥🔥🔥2026-09-30米FTC、OpenAI や Anthropic など AI 企業の製品リスク調査を開始米連邦取引委員会が主要AI企業の安全性と製品リスクに関する調査に着手し、業界全体への規制圧力が一段と強まる。FTCOpenAIAnthropicregulation
🔥🔥2026-10-02ソニー・インタラクティブエンタテインメント、PS5向けAI画質向上技術 QSSR を発表──AMD と共同開発し通常モデルに対応PS5 Pro限定だったPSSRの処理を軽量化し、通常版PS5でもAIアップスケーリングを利用可能にすることで、ミドルレンジ機における高画質タイトルの実装コストを最適化する。AIPlayStation 5AMDComputer Vision
🔥🔥2026-10-02OpenAI、ChatGPT に機能追加──AI バーチャル試着と書類スキャン PDF 化を実装ChatGPT の Web およびモバイル版にアパレルのバーチャル試着機能と、複数ページを 1 つの PDF にまとめるカメラスキャン機能を順次追加した。ChatGPTOpenAIProductComputerVision
🔥🔥🔥2026-09-30OpenAI、AI エージェント基盤モデル GPT-6.1 Sol を公開──コストを 1/3 に抑制し AutomationBench で Opus 5.5 を超越OpenAI DevDay 2026 にて、常時稼働エージェント Dots や価格を大幅に引き下げた GPT-6.1 Sol を発表し、エンタープライズの導入敷居を劇的に下げる。OpenAILLMGPT-6.1-SolAgents