🧠Research🔥🔥

huihui-ai、オープンモデル Qwen/Qwen3.8-27B の非抑制版 Huihui-Qwen3.8-27B-abliterated を公開

Qwen3.8-27B の最初の 15 層を維持しつつリフレサル(拒絶反応)を排除した証明概念モデルで、ローカル実行環境での検証を想定する。
リリース: 2026-08-16 · 読了 3

記事の要約

1. 核心(What)

  • huihui-ai は、Qwen/Qwen3.8-27B をベースにした非抑制版モデル「Huihui-Qwen3.8-27B-abliterated」を HuggingFace 上で公開した。
  • モデルは TransformerLens を使用せず、安全フィルターの制限を削減するアブリレーション処理によって構築されている。
  • 公式スクリプトでは HuggingFace transformers ライブラリおよび Ollama による実行に対応している。

2. 影響(Why)

  • ローカル検証の自由度向上: 安全フィルターの制限を受けない 27B クラスのモデルを検証できるため、特定ドメインにおけるモデルの限界や挙動を自前環境で直接テストする実験基盤として活用できる。
  • 国内リサーチ・検証環境への波及: [国内 AI 研究機関・検証チーム] のような小規模組織では、商用 API のコンテンツフィルターに依存せず、オープンモデルの内部挙動や安全機構の影響を直接検証するベースラインとして利用価値がある。

3. 根拠・詳細(How)

  • アブリレーション適用範囲の制限: ベースモデルのレイアウトにおいて最初の 15 層はアブリレーションを回避して保持され、MTP および視覚機能のコードは一切変更せずに維持されている。
  • ストリーミングとメトリクス計測の実装: transformers ライブラリをベースとしたカスタムテキストストリーマーにより、初回トークン遅延やトークン生成速度、思考トークン数を測定する機能が実装されている。

4. 展望・課題(Next)

  • 商用利用におけるリスク管理: 公式に安全性保証が行われておらず、法的・倫理的リスクが伴うため、公開サービスや商用環境への直接投入は推奨されていない。