🔥🔥🔥2026-06-02Anthropic、自律型脆弱性診断フレームワーク defending-code-reference-harness を公開──検知から修正までを自動化Claude を活用してソースコードの脅威モデリングからパッチ生成までを自動化する、gVisor サンドボックス完備のリファレンス実装。LLMSecurityClaudeAgent
🔥🔥2026-06-04ServiceNow、音声エージェント評価ベンチマーク EVA-Bench 2.0 を公開──3ドメイン・213シナリオに拡大航空・IT・医療の3業種に特化した 121 個のツール操作を含む、実務レベルの音声 AI エージェント評価用オープンソースデータセット。Voice AgentBenchmarkDatasetTool-use
🔥🔥2026-06-04NVIDIA、マルチモーダル安全評価モデル Nemotron 3.5 Content Safety を公開──推論プロセスとカスタムポリシーに対応Gemma 3 4B を基盤に、画像・テキスト・応答の三位一体評価と「思考プロセス」の出力により、金融や医療など特定ドメインの独自安全基準を動的に適用可能にした。NVIDIAGemma 3Content SafetyMultimodal
🔥🔥2026-06-03NVIDIA、物理 AI 基盤モデル 3 種を公開──汎用把持・高速自動運転・仮想環境エージェントロボットの把持から自動運転の推論効率化まで、大規模シミュレーション学習により未知のデバイスや環境への適応能力を大幅に向上させた。NVIDIAPhysical AIRoboticsAutonomous Driving
🔥🔥2026-06-03Dharma AI、DPO を構造化 OCR に適用──テキストのループ発生率を平均 59.4% 削減チャットの「好み」ではなく「正誤」を DPO の信号に使い、SFT では解消困難な自己ループ問題をモデル自身の失敗例から学習して抑制した。DPOOCRLLMFine-tuning
🔥🔥2024-01-31OpenAI、AI 時代のバイオディフェンス戦略を発表──生物学的リスク評価と安全な研究枠組みを提言AI による生物兵器転用リスクを定量化する評価手法を確立し、専門知識の悪用を防ぎつつ科学的発見を加速させるための多層的な防御策を提示した。OpenAISafetyBiosecurityRedTeaming
🔥2021-07-04ライブ配信後の録画視聴はライブ前より価格感度が低い──消費者の支払い意欲の変化を解明大規模プラットフォームのデータからライブ配信の全ライフサイクルにおける需要を分析。録画販売の価格戦略やターゲティングへの応用を示唆。(原題: From Live to Recording: Consumer Demand and Response to Price Across the Livestreaming Lifecycle)LivestreamingPricing StrategyConsumer BehaviorEconomics
🔥🔥2026-06-03セキュリティリサーチ、脆弱性診断ベンチマークを公開──GPT-5.5 が $1,500 の検証で成功率 70% を記録Firebase の設定不備を突く実戦的なハッキングタスクにおいて、GPT-5.5 が DeepSeek や Claude を圧倒する推論性能と自律的なツール操作能力を示した。SecurityLLM BenchmarkGPT-5.5Firebase
🔥🔥2026-05-06EU発、プライベート検索エンジン Uruky が画像検索に対応──AI 機能を排除し Kagi の初期思想を継承広告やトラッキングを一切排除し、12ヶ月の利用でソースコードを開示する「真の所有権」を掲げた、AI 要約に頼らない純粋な検索ツール。Search EnginePrivacyEUNo-AI
🔥🔥2024-06-05Anthropic、LLM サンドボックス基盤の技術構成を公開──gVisor と Firecracker を用途別に使い分け信頼できないコード実行を伴うエージェント機能において、起動速度 100ms 以下の高密度な隔離環境をどのように実現しているかの設計指針を提示した。SandboxingSecurityLLM-AgentsInfrastructure
🔥2024-05-01LEGO、建築モデル「サグラダ・ファミリア」を公開──5,936 ピースでガウディの構造を再現LEGO アーキテクチャ史上最大級のスケールで、複雑な尖塔や彫刻的な細部を 5,936 ピースの物理パーツで再構成した。LEGOArchitectureHacker News
🔥🔥🔥2026-06-05OpenAI・Anthropic・Google DeepMind の CEO、合成核酸発注のスクリーニング義務化を米議会に要請AI 開発トップ 3 社がバイオセキュリティ規制の法制化を共同要請。AI による生物兵器リスクの物理的な封じ込めを狙う。BioSecurityRegulationAI-SafetyOpenAI
🔥🔥2026-06-05米国政府、大西洋子午面循環(AMOC)観測システムを解体──崩壊リスク監視の重要インフラを停止気候変動の臨界点とされる AMOC の監視体制を縮小することで、長期的な気象予測モデルの精度低下と、それに伴うインフラ投資判断への不確実性増大を招く。Climate ChangeData InfrastructureEnvironmental PolicyAMOC
🔥🔥🔥2024-05-29OpenAI、フロンティア AI の民主的ガバナンスに向けた「安全設計図」を公開──意思決定プロセスの透明化を提言AGI 開発に向けた安全基準の策定と、取締役会・安全諮問委員会による多層的な監視体制の構築を明文化した。OpenAIAI GovernanceSafetyAGI
🔥🔥2026-06-04Meta、Facebook クリエイター向け AI アシスタントを公開──投稿タイミングやトレンド分析を対話型で支援複雑なダッシュボード解析を不要にし、自アカウントの過去データとトレンドを掛け合わせた具体的な運用改善案を、米国・カナダ・インドのクリエイターへ提供開始した。MetaFacebookAI AssistantContent Creator
🔥🔥2025-12-25OpenAI、ChatGPT 記憶機能「Dreaming」を導入──長期記憶の自動整理と要約で推論の文脈維持を強化ユーザーとの過去の対話をバックグラウンドで整理・要約し、メモリの断片化を防ぐことで、数ヶ月前の会話に基づいた推論精度を向上させる。ChatGPTMemoryOpenAIPersonalization
🔥🔥2024-05-29OpenAI、ChatGPT に新メモリ機能「Dreaming」を導入──対話履歴を非同期で整理しパーソナライズ精度を向上対話の裏側で「夢を見る」ように情報を再整理・構造化することで、ユーザーが明示的に指示しなくても過去の文脈や好みを正確に反映した回答を実現する。OpenAIChatGPTPersonalizationMemory