library_name: transformers.js
base_model:
- huihui-ai/Huihui-gemma-4-E2B-it-abliterated
pipeline_tag: image-text-to-text
tags: - abliterated
- uncensored
- gemma4
- onnx
- webgpu
license: apache-2.0
Huihui-gemma-4-E2B-it-abliterated (ONNX)
ONNX export of huihui-ai/Huihui-gemma-4-E2B-it-abliterated
(uncensored / abliterated version of google/gemma-4-E2B-it) for use with
Transformers.js in the browser via WebGPU.
Live demo: kermelp/Huihui-gemma4-abliterated-webgpu
Usage with Transformers.js
import { AutoProcessor, Gemma4ForConditionalGeneration, TextStreamer } from "@huggingface/transformers";
const model_id = "kermelp/Huihui-gemma-4-E2B-it-abliterated-ONNX";
const processor = await AutoProcessor.from_pretrained(model_id);
const model = await Gemma4ForConditionalGeneration.from_pretrained(model_id, {
dtype: "q4f16",
device: "webgpu",
});
const messages = [
{
role: "user",
content: [{ type: "image" }, { type: "text", text: "Describe this image." }],
},
];
const prompt = processor.apply_chat_template(messages, {
enable_thinking: false,
add_generation_prompt: true,
});
Conversion
Converted from bf16 safetensors with optimum-cli export onnx --task image-text-to-text,
then quantized to 4-bit weights + fp16 activations (q4f16) with onnxruntime MatMulNBitsQuantizer.
⚠️ This model has had its refusal behavior removed via abliteration. It will answer
prompts the original Gemma 4 refuses. For research and evaluation only.