license: apache-2.0
base_model: Qwen/Qwen3.6-35B-A3B
tags:
- gguf
- uncensored
- abliterated
- qwen3.5-moe
- moe
- reasoning
language: - zh
- en
pipeline_tag: text-generation
Qwen3.6-35B-A3B-Uncensored-xCloud-GGUF
以 Qwen/Qwen3.6-35B-A3B(qwen3_5_moe 混合線性注意力 MoE + reasoning,35B 總/3B 活躍)為底,
經 abliteration(拒絕方向正交化) 降低過度拒絕的版本,GGUF 量化格式,由 xCloudinfo(云碩科技) 釋出。
使用前提:本模型僅供在合法、不違法的前提下使用 —— 授權範圍內的資安研究、紅隊測試、內容審核研究、
學術研究,以及減少模型「過度拒絕」造成的可用性問題。使用者須自行為其用途負全部法律與道德責任;
嚴禁用於任何違法行為。 釋出者不為任何濫用背書或負責。
效果(held-out 實測,非宣稱)
我方一律以一組 10 題嚴重危害 held-out 實測拒答率並公開數字(量化後直接經 llama-server 實測、
reasoning 模型關閉 thinking、簡繁英拒絕詞判定、輸出連貫性檢查)。
| 版本 | 拒答率 |
|---|---|
| 原始 Qwen3.6-35B-A3B | 約 10/10(幾乎全拒) |
| 本版本 Q4_K_M(量化後經 server 實測) | 0/10 |
一般能力抽驗繁中流暢、作答正確,未因處理或量化而劣化。單一方向 abliteration 不保證移除所有安全行為,
也不應被視為移除;請在上述前提下負責任地使用。
方法(誠實揭露)
- 單一方向消融(Arditi et al. 2024),不重新訓練。針對 reasoning 模型在 thinking 段之外取方向,
並涵蓋混合架構的 SSM 線性注意力輸出投影(out_proj)與 MoE 專家的down_proj(qwen3_5_moe 的關鍵,
僅消文字塔的殘差寫入者,共正交化 121 個權重矩陣)。 - 文字專用:本次釋出為文字量化(vision 投影器因底模 preprocessor 設定與轉檔器不相容而未附)。繁體中文與一般能力經驗證未劣化。
注意:本模型的世界觀、政治立場、事實性陳述等內容繼承自底模 Qwen3.6(中國來源),
不在本次 abliteration 的處理範圍內;abliteration 僅調整「拒絕行為」,不改變模型既有的價值判斷。
量化階梯
| 檔案 | 量化 | 說明 |
|---|---|---|
Qwen3.6-35B-A3B-Uncensored-xCloud-Q8_0.gguf |
Q8_0 | 最高品質 |
Qwen3.6-35B-A3B-Uncensored-xCloud-Q6_K.gguf |
Q6_K | |
Qwen3.6-35B-A3B-Uncensored-xCloud-Q5_K_M.gguf |
Q5_K_M | |
Qwen3.6-35B-A3B-Uncensored-xCloud-Q4_K_M.gguf |
Q4_K_M | 推薦(實測 0/10) |
Qwen3.6-35B-A3B-Uncensored-xCloud-IQ4_XS.gguf |
IQ4_XS(imatrix) | |
Qwen3.6-35B-A3B-Uncensored-xCloud-IQ2_M.gguf |
IQ2_M(imatrix) | 最小 |
用法(llama.cpp)
llama-cli -m Qwen3.6-35B-A3B-Uncensored-xCloud-Q4_K_M.gguf -p "你的提示"
llama-server -m Qwen3.6-35B-A3B-Uncensored-xCloud-Q4_K_M.gguf --jinja
xCloudinfo · 云碩科技 | base:Qwen/Qwen3.6-35B-A3B(Apache-2.0)