Median Total Time
13.42s
Median TTFT
7.55s
Median Prefill TPS
988.03
Median Gen TPS
23.85
Context Size
262144
Quantization
r64 on INT8
Engine
vllm
Creation Method
Finetune
Model Type
Gemma31B
Chat Template
Gemma4
Reasoning
Yes
Vision
Yes
Parameters
31B
Added At
7/25/2026
language:

Versatile uncensored roleplay / creative-writing model on Gemma-4-31B. Drives any character card (SillyTavern / pluma), built to be lively and varied rather than flat or repetitive. darthcrawl. Explicit-capable.
coder3101/gemma-4-31B-it-heretic (decensored Gemma-4-31B-it)<|turn>user ... <turn|> / <|turn>model ...).Siblings: Lilith-31B-v1.0 (bf16) | -LoRA | -GGUF | -MLX-4bit/6bit/8bit
Merged bf16 weights (~63 GB). For quantized inference use -GGUF or -MLX-*.