<8B instruct models with AWQ, GPTQ quantizations available
-
Qwen/Qwen2.5-7B-Instruct
Text Generation • 8B • Updated • 10.8M • • 1.56k -
Qwen/Qwen2.5-7B-Instruct-GPTQ-Int4
Text Generation • 8B • Updated • 68.1k • 32 -
Qwen/Qwen2.5-7B-Instruct-AWQ
Text Generation • 8B • Updated • 3.97M • 51 -
meta-llama/Llama-3.2-3B-Instruct
Text Generation • 3B • Updated • 999k • • 2.46k