🧠Research🔥🔥

Zhipu AI、大規模モデル GLM 5.3 を Amazon Bedrock で公開──753B モデリングとサイバーセキュリティ性能を最適化

Zhipu AI の 753B MoE モデル GLM 5.3 が Amazon Bedrock で利用可能になり、フルマネージドなクロスリージョン推論やプロンプトキャッシュに対応した。
リリース: 2026-10-05 · 読了 3 分

記事の要約

1. 核心(What)

  • Z.ai の 753B パラメータ MoE モデル「GLM 5.3」が Amazon Bedrock に追加された。
  • OpenAI 互換の Responses および Chat Completions API を通じてフルマネージドで呼び出し可能である。
  • CyberGym ベンチマークで 84.5 のスコアを記録し、サイバーセキュリティのタスクに特化した強みを持つ。
  • Flex、Priority、Standard の 3 種類のサービスティアを選択してコストとレイテンシを調整できる。

2. 影響(Why)

  • 自前インフラ不要での高精度モデル運用: 753B 規模の巨大モデルを自前でプロビジョニングするコストと運用負荷が解消され、エンタープライズ企業がマネージド環境で安全に検証できる。
  • 国内セキュリティ関連 SaaS への影響: 脆弱性検証エージェント(Strix 等)を自社 AWS アカウント内で安全に実行可能になるため、国内のセキュリティ監査・脆弱性診断を手掛ける中小〜中堅の事業者において、外部 API 依存を避けた検証基盤の選択肢が広がる。

3. 根拠・詳細(How)

  • 明示的プロンプトキャッシュの制御: prompt_cache_options と 1,024 トークン以上のキャッシュブレークポイントを指定することで、反復的なコンテキスト送信のレイテンシと入力コストを削減する。
  • API 統合とトークン生成: aws-bedrock-token-generator ライブラリと OpenAI Python SDK を組み合わせ、短期認証情報を用いた OpenAI 互換エンドポイントへのリクエストを実現している。

4. 展望・課題(Next)

  • 対応顧客層の拡大予定: 現時点では適格なエンタープライズ顧客に限定されているアクセス権限が、段階的に拡大される見込みである。