Expand description
Gemma-4 dedicated text engine (E2B / E4B-style GGUF).
Distinct from generic Gemma-2/3 crate::decoder::Decoder:
- per-layer token embeddings (
per_layer_token_embd+ proj) - shared KV layers (
attention.shared_kv_layers) - SWA vs full layers with different head dims (
key_length/key_length_swa) and a bool SWA pattern array
Graph mirrors .scratch/llama.cpp/src/models/gemma4.cpp.
Structs§
- Gemma4
Attn Weights - Gemma4
Decode State - Gemma4
Engine - Gemma4
Hparams - Hyperparameters from
{arch}.*GGUF metadata. - Gemma4
Layer Weights - Gemma4
Weights
Constants§
- GEMM
A4_ ARCHES - Architectures served by this engine.