File size: 1,211 Bytes
d891c8d
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
=== Laguna-S-2.1-RFA ===
arch: laguna
codebook: [-127, -104, -83, -65, -49, -35, -22, -10, 1, 13, 25, 38, 53, 69, 89, 113]
rotation: hadamard16

[integrity] shards=13 missing=none
[integrity] index total_size=71.16GB  on-disk safetensors sum=71.17GB
[integrity] tensors: index=109249 headers=109249 OK

[coverage] quantized expert-mods=0 linear-mods=36240 fp16-protected=0 copied=529
[coverage] missing/bad: 0

[bpw] quant-target params=114.10B  rfa bytes=64.25GB  -> 4.504 bits/weight
[size] total=71.16GB = rfa 64.25GB + copied(bf16/other) 6.91GB

[fidelity] dequant vs source (relFro / SQNR):
   model.layers.0.mlp.down_proj  relFro=6.150%  SQNR=24.2 dB
   model.layers.0.mlp.gate_proj  relFro=6.311%  SQNR=24.0 dB
   model.layers.0.mlp.up_proj  relFro=6.304%  SQNR=24.0 dB
   model.layers.24.mlp.experts.0.down_proj  relFro=6.328%  SQNR=24.0 dB
   model.layers.24.mlp.experts.0.gate_proj  relFro=6.334%  SQNR=24.0 dB
   model.layers.24.mlp.experts.0.up_proj  relFro=6.335%  SQNR=24.0 dB
   model.layers.47.mlp.experts.0.down_proj  relFro=6.338%  SQNR=24.0 dB
   model.layers.47.mlp.experts.0.gate_proj  relFro=6.340%  SQNR=24.0 dB
   model.layers.47.mlp.experts.0.up_proj  relFro=6.336%  SQNR=24.0 dB

DONE