Median Total Time
24.68s
Median TTFT
6.51s
Median Prefill TPS
898.33
Median Gen TPS
24.84
Context Size
262144
Quantization
r64
Engine
vllm
Creation Method
LoRA Finetune
Model Type
Gemma31B
Chat Template
Gemma4
Reasoning
Yes
Vision
Yes
Parameters
31B
Added At
7/25/2026
language:

Versatile uncensored roleplay / creative-writing model on Gemma-4-31B. Drives any character card (SillyTavern / pluma), built to be lively and varied rather than flat or repetitive. darthcrawl. Explicit-capable.
coder3101/gemma-4-31B-it-heretic (decensored Gemma-4-31B-it)<|turn>user ... <turn|> / <|turn>model ...).Siblings: Lilith-31B-v1.0 (bf16) | -LoRA | -GGUF | -MLX-4bit/6bit/8bit
Merged bf16 weights (~63 GB). For quantized inference use -GGUF or -MLX-*.