language:
- en
- zh
license: apache-2.0
tags: - unsloth
- fine tune
- heretic
- uncensored
- abliterated
- multi-stage tuned.
- all use cases
- coder
- creative
- creative writing
- fiction writing
- plot generation
- sub-plot generation
- fiction writing
- story generation
- scene continue
- storytelling
- fiction story
- science fiction
- romance
- all genres
- story
- writing
- vivid prosing
- vivid writing
- fiction
- roleplaying
- bfloat16
- all use cases
datasets: - TeichAI/claude-4.5-opus-high-reasoning-250x
- DavidAU/PkDick-Deckard-5-Datasets
base_model: - DavidAU/Qwen3.5-27B-Deckard-PKD-Heretic-Uncensored-Thinking
pipeline_tag: image-text-to-text
library_name: transformers
Qwen3.5-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking — MLX 4.5 BPW
Mixed-precision MLX quantization of DavidAU/Qwen3.5-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking, quantized with MLX Smart Quantize (MSQ) — my own sensitivity-based mixed-precision quantization method for Apple Silicon. It measures per-layer NMSE and assigns optimal bit widths automatically, combining architecture knowledge with measured data.
Details
- Type: Vision (VLM)
- Average: 4.5 bits per weight
- Method: MLX Smart Quantize (MSQ)
- AWQ scaling: applied to 120 groups