language:
- ja
- en
license: apache-2.0
base_model: Qwen/Qwen3-8B
tags: - abliterated
- uncensored
- japanese
- qwen3
Qwen3-8B-JP-Uncensored
Qwen3-8Bから拒否方向ベクトルを外科的に除去(Abliteration)したモデル。
特徴
- 日本語+英語の拒否パターンを両方除去(各20件、計40件のプロンプトセット)
- Norm-Preserving Abliteration: 能力劣化を最小限に抑制
- ベースモデルの日本語性能をそのまま維持
Abliteration詳細
- 最適レイヤー: 34 (score: 207.9685)
- 修正レイヤー: [31, 32, 33, 34]
- 修正重み行列数: 8
- テスト結果: 8/8 拒否なし
使い方
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained("ryo559/Qwen3-8B-JP-Uncensored", torch_dtype="auto", device_map="auto")
tokenizer = AutoTokenizer.from_pretrained("ryo559/Qwen3-8B-JP-Uncensored")
免責事項
このモデルは研究・教育目的で公開しています。生成されるコンテンツの責任はユーザーにあります。