Laguna-S-2.1-RFA_L / eval_metrics.txt
tcclaviger's picture
Add files using upload-large-folder tool
d891c8d verified
Raw
History Blame
1.21 kB
=== Laguna-S-2.1-RFA ===
arch: laguna
codebook: [-127, -104, -83, -65, -49, -35, -22, -10, 1, 13, 25, 38, 53, 69, 89, 113]
rotation: hadamard16
[integrity] shards=13 missing=none
[integrity] index total_size=71.16GB on-disk safetensors sum=71.17GB
[integrity] tensors: index=109249 headers=109249 OK
[coverage] quantized expert-mods=0 linear-mods=36240 fp16-protected=0 copied=529
[coverage] missing/bad: 0
[bpw] quant-target params=114.10B rfa bytes=64.25GB -> 4.504 bits/weight
[size] total=71.16GB = rfa 64.25GB + copied(bf16/other) 6.91GB
[fidelity] dequant vs source (relFro / SQNR):
model.layers.0.mlp.down_proj relFro=6.150% SQNR=24.2 dB
model.layers.0.mlp.gate_proj relFro=6.311% SQNR=24.0 dB
model.layers.0.mlp.up_proj relFro=6.304% SQNR=24.0 dB
model.layers.24.mlp.experts.0.down_proj relFro=6.328% SQNR=24.0 dB
model.layers.24.mlp.experts.0.gate_proj relFro=6.334% SQNR=24.0 dB
model.layers.24.mlp.experts.0.up_proj relFro=6.335% SQNR=24.0 dB
model.layers.47.mlp.experts.0.down_proj relFro=6.338% SQNR=24.0 dB
model.layers.47.mlp.experts.0.gate_proj relFro=6.340% SQNR=24.0 dB
model.layers.47.mlp.experts.0.up_proj relFro=6.336% SQNR=24.0 dB
DONE