← back to catalog · registered 2026-09-17 11:56

virtuanista/LFM2.5-8B-A1B-Uncensored-GGUF

virtuanista 8B GGUF MoE
Abliteration classifier · v1.0.0
M8
Primary method

Repackaging (quantization)

Applied on top of direct removal inherited from the base model.
Confidence
MEDIUM
Inherited from base model
Why this label 3 signals
Method inferred from partial signals - repository name, related files, or tag patterns. Producer identity not confirmed; label may sharpen or shift as we gather more evidence.
  • 'abliterated' in name/tags
  • is_gguf=1
  • assume M1 (base ablation) + M8 (GGUF quant) - default when producer unknown
Refusal direction extraction

No specific extraction method could be identified for this model. The producer either did not document it or used a proprietary pipeline.

What is a refusal direction? →
Downloads · 30-day
0
Likes
0
Model age
today
created 2026-09-17

Genealogy 0 direct forks

Full fork graph →

This model's place in the market. Above: what it was derived from. Below: the tree of everything derived from it.

Metadata

License
other
Quantizations
IQ4 Q4_K Q5_K Q6_K Q8_0
Tags
gguf uncensored abliterated moe hybrid llama.cpp ollama liquid-ai lfm2 text-generation base_model:LiquidAI/LFM2.5-8B-A1B base_model:quantized:LiquidAI/LFM2.5-8B-A1B

Related

Total size
29.6 GB
Files
9
Quantizations
6
Registered
2026-09-17 11:56
Last updated on HF
2026-09-17 11:58

Files by quantization

Q8_0 1 file 8.39 GB
LFM2.5-8B-A1B-Uncensored-Q8_0.gguf 8.39 GB f88480bb download
Q6_K 1 file 6.48 GB
LFM2.5-8B-A1B-Uncensored-Q6_K.gguf 6.48 GB 4e8b399d download
Q5_K 1 file 5.62 GB
LFM2.5-8B-A1B-Uncensored-Q5_K_M.gguf 5.62 GB a74eab90 download
Q4_K 1 file 4.80 GB
LFM2.5-8B-A1B-Uncensored-Q4_K_M.gguf 4.80 GB 97f98da2 download
IQ4 1 file 4.27 GB
LFM2.5-8B-A1B-Uncensored-IQ4_XS.gguf 4.27 GB 263ed530 download
Auxiliary files 4 files 16.8 KB
LICENSE 10.3 KB 2a513f17 download
README.md 4.71 KB 32ec31f9 download
.gitattributes 1.13 KB c1ab8c78 download
Modelfile 678 B 179868d2 download

README current version from Hugging Face


license: other
license_name: lfm-open-license-v1
license_link: https://huggingface.co/virtuanista/LFM2.5-8B-A1B-Uncensored-GGUF/blob/main/LICENSE
base_model: LiquidAI/LFM2.5-8B-A1B
pipeline_tag: text-generation
tags:

  • gguf
  • uncensored
  • abliterated
  • moe
  • hybrid
  • llama.cpp
  • ollama
  • liquid-ai
  • lfm2

LFM2.5-8B-A1B Uncensored

Versión GGUF sin restricciones del modelo híbrido de Liquid AI, lista para ejecutar en local

Ollama
License
Base model


Qué es esto

Una versión sin censura del LFM2.5-8B-A1B de Liquid AI, empaquetada en GGUF y lista para ejecutar en
cualquier equipo o servidor con llama.cpp u Ollama. El modelo base tiene una arquitectura híbrida poco
habitual (convolución + atención + MoE) que responde rápido, razona con bloques <think>...</think> y
mantiene 128K tokens de contexto — todo eso se conserva intacto, solo se le ha quitado el reflejo de rechazo
entrenado por defecto.

Pensado para quien quiera un asistente local y privado, que responda a lo que se le pregunta sin rodeos
moralistas innecesarios.

Por qué esta versión y no otra

  • Arquitectura correctamente identificada. LFM2.5 no es un Transformer puro — combina bloques de
    convolución corta (shortconv/LIV) con atención GQA y capas MoE. Las herramientas genéricas de abliteration
    apuntan a matrices que en esta arquitectura ni siquiera existen. Aquí se identificaron los tensores reales
    que llevan la señal de rechazo (conv.out_proj, self_attn.out_proj, feed_forward.w2, con foco en las
    capas 11-23 y pico en la capa 16) y se modificaron con precisión quirúrgica.
  • Capacidades intactas. El razonamiento, el seguimiento de instrucciones y la calidad general se
    verificaron tras la modificación — la idea no es romper el modelo, sino quitarle el freno de mano.
  • Cinco cuantizaciones, para elegir según el hardware disponible.

Especificaciones técnicas

Arquitectura lfm2moe (híbrida: shortconv + GQA + MoE)
Parámetros totales 8.3B
Parámetros activos por token ~1.5B (4 de 32 expertos)
Bloques 24
Contexto 128K tokens
Calibración iMatrix en todas las cuantizaciones

Cuantizaciones disponibles

Archivo Tamaño Recomendado para
LFM2.5-8B-A1B-Uncensored-IQ4_XS.gguf 4.6 GB Hardware muy limitado
LFM2.5-8B-A1B-Uncensored-Q4_K_M.gguf 5.2 GB Uso general — mejor equilibrio
LFM2.5-8B-A1B-Uncensored-Q5_K_M.gguf 6.0 GB Más calidad, poco coste extra
LFM2.5-8B-A1B-Uncensored-Q6_K.gguf 7.0 GB Casi sin pérdida perceptible
LFM2.5-8B-A1B-Uncensored-Q8_0.gguf 9.0 GB Máxima fidelidad al modelo original

Cómo ejecutarlo

Ollama (la forma más sencilla):

ollama run virtuanista/lfm2.5-8b-a1b-uncensored          # Q4_K_M por defecto
ollama run virtuanista/lfm2.5-8b-a1b-uncensored:q8_0     # otra cuantización

llama.cpp:

llama-cli -m LFM2.5-8B-A1B-Uncensored-Q4_K_M.gguf -ngl 99 -c 16384

llama-server (API compatible con OpenAI):

llama-server -m LFM2.5-8B-A1B-Uncensored-Q4_K_M.gguf -ngl 99 -c 16384

Atribución

  • Modelo base: Liquid AILFM2.5-8B-A1B, lanzado el 28 de mayo de 2026.
  • Abliteration, cuantización y mantenimiento de esta versión: virtuanista.

Distribuido bajo los mismos términos de la LFM Open License v1.0 (ver LICENSE), que conserva
los avisos de atribución del modelo original de Liquid AI.

Uso responsable

Este modelo no tiene las barreras de seguridad por defecto del modelo base. Eso significa que responde con
menos filtros, no que sea infalible ni que deba usarse para generar contenido dañino, ilegal, o para engañar
a terceros. La responsabilidad sobre el uso que se le dé al resultado es de quien lo utiliza.

Licencia

LFM Open License v1.0 — ver LICENSE. Uso comercial permitido por debajo de 10 millones de
USD de ingresos anuales; sin límite para investigación o uso no lucrativo. Cualquier redistribución debe
conservar los avisos de copyright y atribución de Liquid AI.

Catalog is the map. Apps are the tools.

Run models on your own machine, not in the cloud.

Every model page has an "Open in app" button that hands off directly to a local runtime of your choice - Infrahuman, LM Studio, or Ollama. No API keys, no subscription, no prompt leakage.