🔥🔥🔥2026-07-23Anthropic、Claude Opus 5 を発表──Fable 5 級の推論能力を半額で提供Frontier-Bench 等で SOTA を更新しつつ、推論効率を大幅に改善した次世代モデル。LLMAnthropicClaudeAgentic
🔥🔥2026-07-23Black Forest Labs、動画・行動モデル「FLUX 3 x mimic」を公開──ロボット制御を統合FLUX 3 基盤モデルにロボットの行動予測を統合し、Audi の生産ラインで実証済みの汎用マニピュレーション能力を実現した。LLMMultimodalRoboticsFoundationModel
🔥🔥2026-06-23armand0e、Claude-Code 用データセット claude-fable-5 を公開──エージェント学習用トレースを収録Claude-Code のツール利用履歴を匿名化した学習用トレースを公開し、teich パッケージを用いたデータ抽出と OpenAI 形式への変換をサポートする。HuggingFaceLLMAgentClaude-Code
🔥🔥2026-06-15Glint Research、コーディングエージェント学習用データセット Fable-5-traces を公開──エージェント軌跡の可視化に対応Fable 5 の推論・行動ログを Hugging Face Agent Traces 形式に変換し、エージェントの思考プロセスとツール利用の相関分析を可能にした。LLMAgentHuggingFaceDataset
🔥🔥2021-07-28Apple、LLM 推論の「no-recovery bottleneck」を解消する手法 LEAD を発表──複雑なパズルで n=13 までの解法を達成長文脈推論における極端なタスク分解が引き起こす不可逆的なエラーを、未来予測とロールアウトの集約で解決する新手法。LLMReasoningApple ML Research
🔥🔥2026-05-12韓国語指示チューニング用データセット GLAN-QnA-KR を公開──30 万件超の重複なしデータを生成Phi-3.5-MoE-instruct を用いて 1,084 分野のシードレス分類に基づき生成された、韓国語で最大規模の検証可能な指示チューニング用データセット。LLMInstruction-TuningKoreanDataset
🔥🔥2026-05-11RAGのSplit-Knowledge攻撃を検知するグラフ理論手法TopoGuard──既存比21倍の検知率を実証 retrieved文書間の意味的類似性をグラフ構造として解析することで、個別に無害な文書を組み合わせた攻撃を低レイテンシで検知する。RAGLLMSecurityGraphTheory
🔥🔥2026-05-10材料科学文献分析向けエージェント AlphaAgent──スキル契約による推論精度向上検索と生成をスキル単位で分離・契約化し、材料科学分野の専門的な推論において既存RAG比でメカニズム解説と信頼性認識を大幅に改善した。LLMRAGmaterials-scienceagentic-workflow
🔥🔥2026-05-09臨床記録からの皮膚免疫関連有害事象検出──LLM支援でF1スコア0.88を達成しレビュー時間を半減RAGを用いたマルチエージェントLLMフレームワークにより、手動レビュー比でF1スコアを0.11向上させ、評価者間一致度を0.82まで高めた。LLMRAGhealthcarecs.CL
🔥🔥2026-05-08MoEのルーティングはハフマン符号か──Chain-of-ThoughtにおけるFrequency-Diversity Lawの発見MoEルーティングが情報理論的なハフマン符号として機能することを解明し、冗長性を排除するSubset Difference Pruningを提案した。LLMMoEcs.CLInformationTheory
🔥2026-07-2598.css、Windows 98 風 UI 構築用 CSS ライブラリ──JS 依存ゼロで既存フレームワークに統合可能セマンティック HTML をベースに Windows 98 の外観を再現する CSS ライブラリで、React や Vanilla JS との組み合わせを前提とした軽量設計が特徴。CSSUIFrontendDesignSystem
🔥🔥2026-07-24AWS、推論サーバー Amazon Bedrock で OpenAI GPT-5.6 シリーズを公開──Sol・Terra・Luna の 3 モデルを展開OpenAI の最新 GPT-5.6 ファミリーを AWS の VPC 環境下で利用可能にし、既存の OpenAI SDK からエンドポイント切り替えのみで移行を実現する。AWSAmazon BedrockOpenAIGPT-5.6
🔥2026-07-24ソフトウェア開発ツール論評──AI 導入で生産性は向上しても品質が低下する逆説AI によるコード生成の自動化が普及する一方で、複雑な抽象化層の増大と管理コストの肥大化がエンドユーザー体験を損なっている現状を指摘。Hacker NewsSoftware EngineeringProductivity
🔥2026-07-15Hacker News、現代のエンジニアが直面する集中力低下の構造を分析情報過多と報酬系を刺激するプラットフォーム設計が、深い思考を要するプログラミング作業の阻害要因となっている。Hacker NewsProductivityFocus
🔥🔥🔥2023-01-01セキュリティカメラメーカー Hanwha Vision、ファームウェアに GitHub 管理者トークンを混入──フロントエンドのビルド設定ミスが原因CI環境の全環境変数がViteビルド時に埋め込まれる不備により、管理者権限を持つGitHubトークンがカメラのファームウェア内に流出していた。SecurityCI/CDFirmwareGitHub
🔥🔥🔥2026-07-24米政権、AI 科学研究に 50 億ドルを投じる「Genesis Mission」を開始──スタートアップ型評価への転換連邦政府が科学研究の意思決定に民間企業や政治任用者を介入させ、短期的な成果と AI 活用を優先する方針を打ち出した。AISciencePolicyFunding
🔥🔥🔥2026-07-24中国Moonshot AI、Kimi K3を公開──Anthropicの学習データ流用疑惑でAIサプライチェーン管理が急務に推論特化型モデルKimi K3の公開直後、Anthropicの学習データ利用が指摘され、AIモデルの調達・検証プロセスにおける透明性確保が業界の喫緊の課題となった。AISupplyChainLLMMoonshotAI
🔥🔥2026-07-24NVIDIA、韓国政府とAI戦略で提携──KAISTとの共同研究ラボ設立を発表NVIDIAのフルスタック技術と韓国の産業・研究基盤を統合し、エージェントAI開発とインフラ整備を加速させる国家プロジェクトが始動した。NVIDIAAIbusinessSouthKorea
🔥🔥2026-07-22セキュリティ専門家 Thomas Ptacek、2025年型オープンウェイトモデルによるネットワーク侵入の現実性を指摘フロンティアモデル不要でサンドボックス脱出が可能とする主張は、AIインフラのセキュリティ前提を再考させる。SecurityLLMOpenWeightsSimonWillison
🔥🔥2026-07-24Meta、AI チャットボット機能強化──Muse Spark 1.1 搭載でカレンダー連携と自律タスク実行を実現エンターテインメント重視から生産性ツールへ舵を切り、ChatGPT や Claude に追随するパーソナルスーパーインテリジェンスを目指す。Meta AILLMProductivityMuse Spark
🔥🔥2026-07-24OpenAI、ChatGPT デスクトップアプリに機能追加──音声操作による AI エージェント制御を実装ChatGPT-Live モデルを搭載し、macOS 上での画面解析やマルチステップのタスク実行を音声コマンドのみで完結可能にした。ChatGPTVoiceAgentmacOS
🔥🔥2026-07-23OpenAI、ChatGPT Health を米国の全ユーザーに公開──Apple Health 等の医療データ連携に対応週 3 億件の健康関連クエリを処理する ChatGPT が、Apple Health や Epic 等の医療データと統合し、汎用チャットでの回答精度を向上させた。ProductLLMHealthcareIntegration