推論サーバー AcceptMarkdown、Accept ヘッダーによる AI エージェント向け Markdown 送信機能を公開──HTML パース処理を省略しトークン消費量を削減
HTTP コンテントネゴシエーションを利用し、AI エージェントや RAG パイプライン向けにナビゲーションやスクリプトを除いた Markdown を直接返却する。
リリース: 2026-08-28 · 読了 2 分記事の要約
1. 核心(What)
- HTTP コンテントネゴシエーションを活用し、Accept ヘッダーに text/markdown を指定して Web サイトの本文を直接取得する機能を提供
- HTML のナビゲーションやスクリプト、レイアウト用ラッパーを排除し、AI エージェントが処理するプロセスのトークン消費量を削減
- RAG パイプラインの入力データから広告やモーダルオーバーレイなどのノイズを除去し、信号対雑音比を向上
2. 影響(Why)
- コンテキストウィンドウの最適化: HTML のタグやスタイルシートの送受信を省くことで、モデルの初期処理にかかるトークン数とレイテンシを直接削減できる。
- 国内 Web メディア向けの実装: 国内のニュース・技術ブログをスクレイピングする自社 RAG を運用する開発チームは、HTML パーサーを廃して通信量を圧縮できる。
3. 根拠・詳細(How)
- HTTP ヘッダーベースの制御: Accept: text/markdown リクエストヘッダーを送信することで、既存の Web サイト構造を維持したまま、AI クライアント専用の Markdown バリアントを取得する。
4. 展望・課題(Next)
- 対応サーバーの普及予測: 主要な CMS や静的サイトジェネレーターへのミドルウェア組込が進むかが、実用化の鍵となる。