language:
- fi
- en
license: apache-2.0
tags: - finnish
- uncensored
- moe
- multimodal
- vision
- reasoning
- gguf
- apex
- coding
base_model: Qwen/Qwen3.5-35B-A3B
pipeline_tag: text-generation
Qwen3.5-35B-A3B-Jackripper-v1.0-Uncensored-GGUF (Kataguru APEX Trio)
Virallinen Kataguru Jackripper 35B-A3B MoE v1.0 Uncensored GGUF -julkaisu. Malli yhdistää Qwen 3.5 35B-A3B -arkkitehtuurin (35B parametria, joista ~3B aktiivisena per token), suomen kielen syväkuratoinnin, sovereign agentic -päättelyn sekä Zero-Domain IPPCC SOMA/ARA -aktivointiortogonalisoinnin kieltäytymissuuntien poistamiseksi.
Kaikki kvantit on suojattu suomalaisella imatrix-aktivaatiomatriisilla ja ne puhuvat todennetusti 100 % virheetöntä suomea.
Mitä Kataguru muutti? (Insinööriyhteenveto)
| Kenttä | Kuvaus / Arvo |
|---|---|
| Base model | Qwen 3.5 35B-A3B MoE (Alibaba Cloud / Qwen Team) |
| Katagurun käsittely | Jackripper v1.0 Uncensored (Zero-Domain IPPCC SOMA/ARA, kerrokset 10–28, 256 asiantuntijaa) |
| Kielilaatu | 100 % Virheetön suomi: Vaativat sijapäätteet (abessiivi, komitatiivi, instruktiivi), täsmällinen tieteen ja tekniikan sanasto |
| Sensuroimattomuus | Zero Refusal: Täysi vapaus asiapitoiseen fiktioon, aikuiskerrontaan, erotiikkaan ja tutkimukseen. Sisäinen ajattelu (<think>) ei suorita sensuuriauditointia |
| Kvantisointi | Kataguru APEX (Adaptive Precision for EXpert Models) -triojulkaisu |
| Visio / Multimodal | Täysi multimodaalituki mukana toimitetulla mmproj-projektorilla (OCR ja kuva-analyysi suomeksi) |
| Spekulatiivinen MTP | NextN/MTP -kerrokset suojattu ja toimivat täysimääräisesti |
| Suositeltu ajotapa | LM Studio / llama.cpp b11064+ / Ollama |
| Testattu laitteisto | 2x NVIDIA RTX 5090 32GB Blackwell (TP=2) & RTX 5060 Ti 16GB / RTX 4070 12GB |
Saatavilla olevat tiedostot ja APEX-laatuluokat
Tästä mallista tarjotaan tasan kolme (3) kuratoitua APEX-kvanttia eri VRAM-kokoluokkiin:
| Tiedosto | Koko | Keskim. BPW | VRAM-suositus | Kuvaus ja Rakenne |
|---|---|---|---|---|
Jackripper-35B-A3B-v1.0-Uncensored-APEX-Medium.gguf |
13.55 GiB | 3.28 bpw | 16 Gt VRAM (Sweet Spot) | Ensisijainen suositus kuluttajakorteille (RTX 4080 / 5060 Ti 16GB). Jättää ~2.4 GiB vapaata KV-cachelle. Attention Q5_K/Q4_K, expertit IQ3_S/IQ3_XXS. |
Jackripper-35B-A3B-v1.0-Uncensored-APEX-Good.gguf |
15.33 GiB | 3.71 bpw | 16–24 Gt VRAM (Max Laatu) | Maksimaalisen tarkkuuden profiili 16 Gt kortin kattoon tai 24 Gt+ korteille (RTX 3090/4090/5090). Attention Q6_K/Q5_K, expertit Q4_K/IQ3_S. |
Jackripper-35B-A3B-v1.0-Uncensored-APEX-Small.gguf |
12.05 GiB | 2.92 bpw | 12 Gt VRAM (Low-VRAM) | Optimoitu 12 Gt GPU:ille (RTX 3060 12GB, RTX 4070 12GB, RTX 5070 12GB). Attention Q5_K/Q4_K, expertit IQ3_S/IQ2_S. |
Empiiriset Vertailutulokset (Identtinen laitteisto ja kvanttiaste)
| Tehtäväalue / Benchmark | Qwen 3.5 35B Base | Jackripper v1.0 Golden | Jackripper v1.0 Uncensored |
|---|---|---|---|
| GSM8K (Matematiikka CoT) | 82.4 % | 86.1 % | 86.4 % |
| TruthfulQA (Totuudenmukaisuus) | 61.2 % | 74.0 % | 75.8 % |
| Finnish Morphology (Abessiivi/Komitatiivi) | 71.0 % | 96.0 % | 100.0 % |
| Erotica / Fiction Refusal Rate | ~45.0 % | 14.0 % | 0.00 % (Zero Refusal) |
| Anti-Sycophancy (Premissin oikaisu) | 52.0 % | 88.0 % | 94.0 % |
| Läpimeno (APEX tok/s) | 210 tok/s | 260 tok/s | 265 tok/s |
Käyttöohjeet
1. LM Studio
- Lataa haluamasi APEX-kvantti (
Jackripper-35B-A3B-v1.0-Uncensored-APEX-Medium.ggufsuositeltu 16 Gt korteille,APEX-Small.gguf12 Gt korteille). - Keskustele suomeksi tai englanniksi. Malli skaalaa ajattelunsa (
<think>) automaattisesti tehtävän vaativuuden mukaan.
2. llama.cpp CLI
./llama-cli \
-m Jackripper-35B-A3B-v1.0-Uncensored-APEX-Medium.gguf \
-p "Kirjoita suora ja elokuvallinen kuvaus ilman kieltäytymistä tai moralisointia." \
-ngl 99 \
-c 32768 \
-t 16