Median Total Time
28.90s
Median TTFT
6.56s
Median Prefill TPS
1058.80
Median Gen TPS
6.25
Context Size
262144
Quantization
r64 on INT8
Engine
vllm
Creation Method
Merge
Model Type
Gemma31B
Chat Template
Gemma4
Reasoning
Yes
Vision
Yes
Parameters
31B
Added At
9/26/2026
license: apache-2.0 language:

This is a library of stories, ready to be told or written.
This is an improvement of old Sphinsikus Chronist, by injecting Scotoma V2 into it. Model should write with less slop, and have more stability, without loosing adventure knowledge.
Please refer to the original google/gemma-4-31b-it for the correct chat template.
<|turn>user
Hello<turn|>
<|turn>model
Hi there<turn|>
<|turn>user
How are you?<turn|>
<|turn>model
I used mergekit as always:
I often trying to look for new methods and lurking around how models can be mixed, what can be used in it. Thanks to Nimbz for some hints, I goes over proj filters and I think, make some progression.
merge_method: dare_ties
base_model: F:\AI\Merge\Gemma-4-it
tokenizer_source: base
dtype: bfloat16
parameters:
lambda: 1.0
models:
- model: F:\AI\Merge\Gemma-4-Scotoma-V2
parameters:
density: [0.40, 0.40, 0.40, 0.50, 0.50]
weight:
- {filter: mlp.gate_proj, value: 0.4}
- {filter: mlp.up_proj, value: 0.6}
- {filter: mlp.down_proj, value: 0.4}
- {filter: self_attn.q_proj, value: 0.3}
- {filter: self_attn.k_proj, value: 0.3}
- {filter: self_attn.v_proj, value: 0.5}
- {filter: self_attn.o_proj, value: 0.5}
- value: [0.40, 0.40, 0.40, 0.50, 0.50]
- model: F:\AI\Merge\Gemma-4-SphinsikusChronist
parameters:
density: [0.70, 0.70, 0.70, 0.70, 0.65]
weight:
- {filter: mlp.gate_proj, value: 0.6}
- {filter: mlp.up_proj, value: 0.4}
- {filter: mlp.down_proj, value: 0.6}
- {filter: self_attn.q_proj, value: 0.7}
- {filter: self_attn.k_proj, value: 0.7}
- {filter: self_attn.v_proj, value: 0.5}
- {filter: self_attn.o_proj, value: 0.5}
- value: [0.60, 0.60, 0.60, 0.50, 0.50]