2026-09-19 · 8 topics
個人開発者、Claude を用いて Conway の超現実数に関する 50 年越しの未解決予想を証明
🔥🔥非数学者が Claude と共に一ヶ月間トークンを投じて全オムニフィック整数に対する共通細分予想の Lean 証明を完了させた事例。
元OpenAI研究者、言語を出力しない非LLMモデル Jev を公開──確率と較正された決定を生成し安全性を確保
🔥🔥テキストではなく較正された確率を出力することでハルシネーションを排除し、LLM比で最大18倍の高速化と圧倒的な低コスト化を実現した。
Alibaba、モデル Qwen3.8-Omni-Flash を公開──音声・動画エージェント処理コストを 89% 削減
🔥🔥100万トークンの文脈窓とエージェント型知覚を統合し、長尺動画の入力コストを前世代比で約 89% 圧縮した。
Sakana AI、新組織 Frontier Intelligence Group を設立──Transformer 非依存の学習手法を探索
🔥🔥Transformer の限界を克服するため、局所更新による 1,000 層学習や神経科学ベースの時系列モデルを検証する研究組織を発足した。
Apple、学習レシピ Dynamically Scaled Activation Steering を発表──介入強度を動的制御し生成モデルの性能低下を抑制
🔥🔥毒性緩和などの介入時に一律適用していた従来手法の課題を解決し、入力文脈に応じてレイヤー間のステアリング強度を適応変調する新フレームワーク。
China Telecom、モデル Xing4.0-29B-A4B を公開──29B パラメータで 4B アクティブの MoE 構造
🔥🔥Ascend NPU プラットフォームと MindSpore で全面学習された総パラメータ 29B・アクティブ 4B の MoE モデルで、256K から 512K の長文脈をネイティブサポートする。
Meta、Llama 3.1 8B Instruct のライセンス条件と利用規約を公開──月間アクティブユーザー 7 万万人超の商用利用制限を設定
🔥🔥Meta Platforms が公開した Llama 3.1 コミュニティライセンスでは、月間アクティブユーザー数が 7 億人を超える場合に事前の個別許諾が必要となる規定が明記されている。
研究チーム、無限パラメータ LLM アーキテクチャを提案──実行時データから重みを動的生成
🔥🔥固定された事前学習重みに頼らず、ハイパーネットワークで実行時データから動的に重みを生成することで、コンテキストウィンドウの消費を抑えながら動的学習を実現する。