2026-09-09 · 8 topics
ayghri、コーディングアシスタント用スキル i-have-adhd を公開──冗長な前置きを排除し結論ファーストに制御
🔥🔥🔥コーディングエージェントの冗長な挨拶や回りくどい解説を禁止し、10項目のルールで手順を強制出力させるスキル。
iczelia、データ圧縮ツール OSS ライブラリ bzip3 を公開──bzip2 比で最大 6 倍の圧縮サイズを実現
🔥🔥BZip2 の後継として開発された bzip3 は、接尾辞配列を利用した高速な Burrows-Wheeler 変換と order-0 コンテキスト混合エントロピー符号器を採用し、テキストやソースコードの圧縮効率を劇的に改善した。
推論サーバー Deltafin、2.8T モデル Kimi K3 を M5 Max MacBook Pro で実行──4 基の SSD からエキスパートをストリーミングし 1.00 token/s を達成
🔥🔥2.8兆パラメータ・全16エキスパートを無圧縮でローカル動作させる推論サーバーが登場し、128GBのM5 Maxと4基のSSD環境で1.00 token/sの安定稼働を実現した。
NVIDIAら、セキュリティガイドライン SAFE を公開──AIエージェント防衛の枠組みを提示
🔥🔥Linux Foundation傘下のOSAIAを通じ、NVIDIAやCiscoらがAIエージェントの多層防御と共有の仕組みを策定する。
Amazon Web Services、推論サーバー GPT-6 Astra on Amazon Bedrock を公開──Amazon Bedrock 経由で一般提供を開始
🔥🔥Amazon Bedrock の推論エンジン上で OpenAI の GPT-6 Astra を提供し、最大 100 万トークンの長文脈処理と実運用レベルのセキュリティを両立した。
Cohere、推論サーバー用推論サーバー用 OSS 推論エンジン cohere-megakernel を公開──H100 で vLLM 比 1.58 倍の高速化を達成
🔥🔥LLM のデコード処理全体を単一の永続的 CUDA カーネルに統合し、H100 上でメモリ帯域利用率 62% とバッチサイズ 1 で 292 tok/s を実現した。
AWS、推論サーバー比較ベンチマーク「SageMaker AI G7 vs G5 and G6」を公開──Blackwell GPU 搭載 G7 のコストパフォーマンスを実証
🔥🔥NVIDIA Blackwell 搭載の G7 インスタンスが、30B 級 MoE モデルの推論処理において従来世代比でどのような優位性を持つかを検証するガイドと実測データを AWS が公開した。
Gradium、音声生成ツール Voice Design を公開──7,627 件の比較テストで ElevenLabs を上回る勝率を記録
🔥🔥テキストプロンプトから合成音声を数秒で生成可能にし、全プランで無料で提供することで音声エージェント開発における調達・ライセンスコストを削減する。