🔥🔥🔥2026-07-23OpenAI、機能追加 ChatGPT Health を全米公開──Apple Health 等と連携し 3 億人の週次ユーザーへ提供専用タブでの限定運用を廃止し、サイドバーで管理する健康データを全チャットに常時コンテキストとして反映する仕様へ刷新した。ChatGPTHealthLLMRAG
🔥🔥2026-07-23AMDとCerebras、HeliosとWafer-Scale Engineを統合──推論性能を5倍に向上AMDの最新ラックシステムHeliosとCerebrasのWSE-3を組み合わせ、メモリ帯域のボトルネックを解消することで1兆パラメータ超のモデル推論を高速化する。LLMInferenceHardwareAMD
🔥🔥2026-07-23MIT CSAIL、RLM を用いた推論ハネスによる長文脈汎化手法を公開──短文学習モデルで 8-32 倍のタスクを処理モデルのパラメータを増やす前に、ReAct 等のループ構造が引き起こすコンテキストドリフトを解消するハネス設計が長文脈性能を左右する。LLMAgentResearchContextWindow
🔥🔥2026-07-23Black Forest Labs、マルチモーダルモデル FLUX 3 を発表──動画・音声・ロボット制御を統合画像・動画・音声を単一のバックボーンで学習し、Runway Gen-4.5 を上回る生成精度と工場ロボット制御への応用を実現した。MultimodalFLUXRoboticsGenerativeAI
🔥🔥2026-07-22Prime Intellect、36.5 万件のタスクを統合したエージェント学習用フレームワークを公開23 種類のエージェントタスクセットを単一 API で提供し、SWE-bench や TerminalBench 等の断片化した評価・学習環境を統一する。RLAgentic-AISWE-benchFramework
🔥🔥2026-07-22Browser Use、AI エージェントによる Web ゲーム自動生成・テスト機能「game-mode」を公開自然言語プロンプトから Web ゲームを構築し、ブラウザ上で自律的にプレイ・デバッグまで完結させるエージェント環境。AI AgentWeb DevelopmentLLMFrontend
🔥🔥2026-07-22SLPO:潜在推論に強化学習を導入しテスト時スケーリングを実現する手法潜在推論モデルに対し、代理ポリシーによる報酬割り当てと停止判断ヘッドを導入することで、計算リソースを動的に配分しPass@kを改善した。arXivcs.CLLLMReinforcementLearning
🔥🔥2026-07-22金融感情分析のコストを削減するマルチエージェント手法TriAgent──GPT-4o-mini比で年間930万ドルのコスト削減文脈粒度の異なるエージェント間の意見不一致を指標化し、適切なモデルへルーティングすることで、精度を維持しつつ推論コストを最適化する。LLMMulti-AgentFinancialcs.CL
🔥🔥2026-07-22LRMの推論を最適化するEvoThink──冗長ステップの剪定と失敗からの学習で効率と精度を両立推論軌跡を原子ユニットに分解し、冗長な検証ステップを剪定するSPTと、失敗から正解を導くAha-Moment Preference Optimizationにより、トークン消費を抑えつつ推論能力を向上させた。LLMReasoningOptimizationarXiv
🔥🔥2026-07-22250B MoEモデルSolar Open 2を公開──1Mトークン長文脈とエージェント特化学習で性能向上1Mトークンのコンテキスト窓とMulti-teacher On-Policy Distillationにより、同規模のオープンウェイトモデルを凌駕するエージェント性能を実現した。LLMMoEAgentcs.CL
🔥🔥2026-07-21Apple M5 Neural Accelerator対応推論ランタイムBaseRT──llama.cpp比最大6.4倍のスループットを実現Apple M5の専用Neural Acceleratorを直接活用するMetal 4カーネルにより、プロンプト処理で最大6.4倍、デコードで最大1.75倍の高速化を達成した。LLMApple SiliconInferencecs.AR
🔥🔥2026-07-24個人開発者、モデルルーティングツール Echo を公開──Fable 級の推論品質をコスト 1/3 で実現複数のオープンウェイトモデルを動的に組み合わせるルーティング手法により、単一モデル運用と比較して推論コストを大幅に抑制する。Hacker NewsLLMModel Routing
🔥🔥2026-07-23Cactus、推論信頼度スコアを出力する OSS モデル Cactus Hybrid を公開──動的ルーティングで推論コストを最適化Gemma 4 をベースに回答の正誤を 0-1 の信頼度スコアで出力するプローブを統合し、低コストモデルと高精度モデルの自動切り替えを実現した。LLMOSSGemmaInference
🔥2026-07-23OSS ホスティング Codeberg、LLM・暗号資産プロジェクトを規約で制限──非営利組織のガバナンスに疑念GitHub の「enshittification」を避けて移行したユーザーが、Codeberg の恣意的なコンテンツ規制と運営の姿勢を批判。OSSCodebergGitHubLLM
🔥2026-07-07Codeberg、OSS ホスティング基盤から暗号資産関連プロジェクトを排除──規約改定で全禁止へ暗号資産プロジェクトを「評判を損なうコンテンツ」と定義し、Assembly 投票を経て禁止措置を正式決定した。Hacker NewsOSSCodeberg
🔥2025-08-29HumanLayer、AI コーディングエージェントの限界を指摘──「ソフトウェア工場」モデルの功罪を分析AI によるコード生成の自動化が引き起こすコードベースの品質低下と、エンジニアリングにおける人間介入の必要性を論じる。AICodingAgentsSoftwareEngineeringHackerNews
🔥🔥2026-07-24Namecheap、電話での依頼のみでアカウント乗っ取りを許容──13年利用の顧客が脆弱性を告発本人確認なしで第三者にアカウント権限を譲渡する運用体制が露呈し、ドメイン管理の信頼性に深刻な懸念が生じている。Hacker NewsDomainSecurityBusiness
🔥🔥🔥2026-07-23AIチップ開発のEtched、シリーズCで103億ドルの評価額を達成──Transformer特化型ハードウェアで受注10億ドル突破Transformerアーキテクチャに特化した独自チップで推論のボトルネックを解消し、Nvidia GPU優位の市場で評価額を7ヶ月で倍増させた。AIHardwareLLMTransformer
🔥🔥🔥2026-07-23米議会、AI 停止義務化法案を策定──DHS による強制シャットダウン権限と最大日額 2,000 万ドルの罰金AI モデルの制御不能時に政府が強制停止を命じる「AI Kill Switch Act」が提出され、開発企業には緊急遮断機能の実装と安全インシデント報告が義務付けられる。AIregulationbusiness
🔥🔥🔥2026-07-23NVIDIAフアンCEO、日本をAIインフラ拠点に指名──10年続く半導体バブルと電力供給の勝算AIを「電力消費型の新インフラ」と定義し、日本をグローバルなAI開発の最前線に据える戦略を表明した。NVIDIAAISemiconductorInfrastructure
🔥🔥2026-07-23Amazon、Alexa Plus に MCP を導入──スマートホーム機器の連携を大幅拡大Bosch や Yale Home など複数メーカーの家電を自然言語で制御可能にし、MCP 採用で外部サービス連携を加速させる。AmazonAlexaMCPSmartHome
🔥🔥2026-07-23Anthropic、Claude Voice Mode を刷新──Opus/Sonnet/Haiku のモデル選択と外部アプリ連携に対応会話モデルの選択肢を拡大し、Gmail や Slack 等の外部アプリ操作を統合することで、音声対話による実務支援を強化した。AnthropicClaudeVoiceModeLLM