Add q3_k (imatrix, near-lossless, 69MB) + imatrix .dat calibration files 725856f verified Luigi commited on Jun 17
Document q8_0/q4_k as recommended formats + quant sweep guidance ba5e814 verified Luigi commited on Jun 17
Add Q8_0 variants (lossless: token-exact with f16, ~half size, ~1.2x faster on CPU) 1fe4acb verified Luigi commited on Jun 16
Add all 4 streaming chunk variants (f16 + Q4_K) + model card 54f2bef verified Luigi commited on Jun 16