Instructions to use mradermacher/Quantum-X-i1-GGUF with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use mradermacher/Quantum-X-i1-GGUF with Transformers:
# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("mradermacher/Quantum-X-i1-GGUF", device_map="auto") - llama-cpp-python
How to use mradermacher/Quantum-X-i1-GGUF with llama-cpp-python:
# !pip install llama-cpp-python from llama_cpp import Llama llm = Llama.from_pretrained( repo_id="mradermacher/Quantum-X-i1-GGUF", filename="Quantum-X.i1-IQ1_M.gguf", )
llm.create_chat_completion( messages = "No input example has been defined for this model task." )
- Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- llama.cpp
How to use mradermacher/Quantum-X-i1-GGUF with llama.cpp:
Install (macOS, Linux)
curl -LsSf https://llama.app/install.sh | sh # Start a local OpenAI-compatible server with a web UI: llama serve -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M # Run inference directly in the terminal: llama cli -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M
Install from WinGet (Windows)
winget install llama.cpp # Start a local OpenAI-compatible server with a web UI: llama serve -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M # Run inference directly in the terminal: llama cli -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M
Use pre-built binary
# Download pre-built binary from: # https://github.com/ggerganov/llama.cpp/releases # Start a local OpenAI-compatible server with a web UI: ./llama-server -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M # Run inference directly in the terminal: ./llama-cli -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M
Build from source code
git clone https://github.com/ggerganov/llama.cpp.git cd llama.cpp cmake -B build cmake --build build -j --target llama-server llama-cli # Start a local OpenAI-compatible server with a web UI: ./build/bin/llama-server -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M # Run inference directly in the terminal: ./build/bin/llama-cli -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M
Use Docker
docker model run hf.co/mradermacher/Quantum-X-i1-GGUF:Q4_K_M
- LM Studio
- Jan
- Ollama
How to use mradermacher/Quantum-X-i1-GGUF with Ollama:
ollama run hf.co/mradermacher/Quantum-X-i1-GGUF:Q4_K_M
- Unsloth Studio
How to use mradermacher/Quantum-X-i1-GGUF with Unsloth Studio:
Install Unsloth Studio (macOS, Linux, WSL)
curl -fsSL https://unsloth.ai/install.sh | sh # Run unsloth studio unsloth studio -H 0.0.0.0 -p 8888 # Then open http://localhost:8888 in your browser # Search for mradermacher/Quantum-X-i1-GGUF to start chatting
Install Unsloth Studio (Windows)
irm https://unsloth.ai/install.ps1 | iex # Run unsloth studio unsloth studio -H 0.0.0.0 -p 8888 # Then open http://localhost:8888 in your browser # Search for mradermacher/Quantum-X-i1-GGUF to start chatting
Using HuggingFace Spaces for Unsloth
# No setup required # Open https://huggingface.co/spaces/unsloth/studio in your browser # Search for mradermacher/Quantum-X-i1-GGUF to start chatting
- Pi
How to use mradermacher/Quantum-X-i1-GGUF with Pi:
Start the llama.cpp server
# Install llama.cpp: brew install llama.cpp # Start a local OpenAI-compatible server: llama serve -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M
Configure the model in Pi
# Install Pi: npm install -g @mariozechner/pi-coding-agent # Add to ~/.pi/agent/models.json: { "providers": { "llama-cpp": { "baseUrl": "http://localhost:8080/v1", "api": "openai-completions", "apiKey": "none", "models": [ { "id": "mradermacher/Quantum-X-i1-GGUF:Q4_K_M" } ] } } }Run Pi
# Start Pi in your project directory: pi
- Hermes Agent new
How to use mradermacher/Quantum-X-i1-GGUF with Hermes Agent:
Start the llama.cpp server
# Install llama.cpp: brew install llama.cpp # Start a local OpenAI-compatible server: llama serve -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M
Configure Hermes
# Install Hermes: curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash hermes setup # Point Hermes at the local server: hermes config set model.provider custom hermes config set model.base_url http://127.0.0.1:8080/v1 hermes config set model.default mradermacher/Quantum-X-i1-GGUF:Q4_K_M
Run Hermes
hermes
- Atomic Chat new
- OpenClaw new
How to use mradermacher/Quantum-X-i1-GGUF with OpenClaw:
Start the llama.cpp server
# Install llama.cpp: brew install llama.cpp # Start a local OpenAI-compatible server: llama serve -hf mradermacher/Quantum-X-i1-GGUF:Q4_K_M
Configure OpenClaw
# Install OpenClaw: npm install -g openclaw@latest # Register the local server and set it as the default model: openclaw onboard --non-interactive --mode local \ --auth-choice custom-api-key \ --custom-base-url http://127.0.0.1:8080/v1 \ --custom-model-id "mradermacher/Quantum-X-i1-GGUF:Q4_K_M" \ --custom-provider-id llama-cpp \ --custom-compatibility openai \ --custom-text-input \ --accept-risk \ --skip-health
Run OpenClaw
openclaw agent --local --agent main --message "Hello from Hugging Face"
- Docker Model Runner
How to use mradermacher/Quantum-X-i1-GGUF with Docker Model Runner:
docker model run hf.co/mradermacher/Quantum-X-i1-GGUF:Q4_K_M
- Lemonade
How to use mradermacher/Quantum-X-i1-GGUF with Lemonade:
Pull the model
# Download Lemonade from https://lemonade-server.ai/ lemonade pull mradermacher/Quantum-X-i1-GGUF:Q4_K_M
Run and chat with the model
lemonade run user.Quantum-X-i1-GGUF-Q4_K_M
List all available models
lemonade list
uploaded from rich1
Browse files- .gitattributes +24 -0
- Quantum-X.i1-IQ1_M.gguf +3 -0
- Quantum-X.i1-IQ1_S.gguf +3 -0
- Quantum-X.i1-IQ2_M.gguf +3 -0
- Quantum-X.i1-IQ2_S.gguf +3 -0
- Quantum-X.i1-IQ2_XS.gguf +3 -0
- Quantum-X.i1-IQ2_XXS.gguf +3 -0
- Quantum-X.i1-IQ3_M.gguf +3 -0
- Quantum-X.i1-IQ3_S.gguf +3 -0
- Quantum-X.i1-IQ3_XS.gguf +3 -0
- Quantum-X.i1-IQ3_XXS.gguf +3 -0
- Quantum-X.i1-IQ4_NL.gguf +3 -0
- Quantum-X.i1-IQ4_XS.gguf +3 -0
- Quantum-X.i1-Q2_K.gguf +3 -0
- Quantum-X.i1-Q2_K_S.gguf +3 -0
- Quantum-X.i1-Q3_K_L.gguf +3 -0
- Quantum-X.i1-Q3_K_M.gguf +3 -0
- Quantum-X.i1-Q3_K_S.gguf +3 -0
- Quantum-X.i1-Q4_0.gguf +3 -0
- Quantum-X.i1-Q4_1.gguf +3 -0
- Quantum-X.i1-Q4_K_M.gguf +3 -0
- Quantum-X.i1-Q4_K_S.gguf +3 -0
- Quantum-X.i1-Q5_K_M.gguf +3 -0
- Quantum-X.i1-Q5_K_S.gguf +3 -0
- Quantum-X.i1-Q6_K.gguf +3 -0
.gitattributes
CHANGED
|
@@ -34,3 +34,27 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
|
| 34 |
*.zst filter=lfs diff=lfs merge=lfs -text
|
| 35 |
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
| 36 |
Quantum-X.imatrix.gguf filter=lfs diff=lfs merge=lfs -text
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 34 |
*.zst filter=lfs diff=lfs merge=lfs -text
|
| 35 |
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
| 36 |
Quantum-X.imatrix.gguf filter=lfs diff=lfs merge=lfs -text
|
| 37 |
+
Quantum-X.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
|
| 38 |
+
Quantum-X.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
|
| 39 |
+
Quantum-X.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
|
| 40 |
+
Quantum-X.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
|
| 41 |
+
Quantum-X.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
| 42 |
+
Quantum-X.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
|
| 43 |
+
Quantum-X.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
|
| 44 |
+
Quantum-X.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text
|
| 45 |
+
Quantum-X.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
| 46 |
+
Quantum-X.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
|
| 47 |
+
Quantum-X.i1-IQ4_NL.gguf filter=lfs diff=lfs merge=lfs -text
|
| 48 |
+
Quantum-X.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
| 49 |
+
Quantum-X.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
|
| 50 |
+
Quantum-X.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
| 51 |
+
Quantum-X.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
| 52 |
+
Quantum-X.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
| 53 |
+
Quantum-X.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
| 54 |
+
Quantum-X.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
|
| 55 |
+
Quantum-X.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text
|
| 56 |
+
Quantum-X.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
| 57 |
+
Quantum-X.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
| 58 |
+
Quantum-X.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
| 59 |
+
Quantum-X.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
| 60 |
+
Quantum-X.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
|
Quantum-X.i1-IQ1_M.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:5576827d66250480089837e940efadc20d8fa5c94a9ec0cb02d3c67b77844368
|
| 3 |
+
size 317974944
|
Quantum-X.i1-IQ1_S.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:fc2d4e55cafddf1518345ae473715ff87d331bbf22f8815c34c941077537ca54
|
| 3 |
+
size 315829920
|
Quantum-X.i1-IQ2_M.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:58cd6ce81f9da211eb1d93bc1ecd0cf13990dad0031f12628f0c2936e6d9e9f4
|
| 3 |
+
size 328597920
|
Quantum-X.i1-IQ2_S.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:9666f6e8f4820d167ce7ec5e1a23ba96d25d3b4ae3887e8b790247a0bb9e7b31
|
| 3 |
+
size 325737888
|
Quantum-X.i1-IQ2_XS.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:22ef69ca81802fbfd5b16b815c03e024b12019fc797bb2bef0289cbaeeba2de3
|
| 3 |
+
size 324410016
|
Quantum-X.i1-IQ2_XXS.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:9c6ab4214685b630fc97575ba70e74bbcef4e50cf9ff92df139ab6cf29ecec8e
|
| 3 |
+
size 321549984
|
Quantum-X.i1-IQ3_M.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:6ca6c6b2f91d8f985c06b4a8c9fd4c92610d23eb4c6b34a25ecdd46fa537e683
|
| 3 |
+
size 342752928
|
Quantum-X.i1-IQ3_S.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:1632e5ff1b7aa90148390707cab3b1058b5570e07aaaec936f04b050848c71b1
|
| 3 |
+
size 338608032
|
Quantum-X.i1-IQ3_XS.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:55d1095e03eade727aa94857544efb9f6df792c7efef1170d28645d803c80677
|
| 3 |
+
size 338608032
|
Quantum-X.i1-IQ3_XXS.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:6816cc6a337ebad64ec2425c9dc9d2f1840dc95bc94471a688dcaeea90f92b76
|
| 3 |
+
size 333705120
|
Quantum-X.i1-IQ4_NL.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:92058e0a0052ee8cf25b1beb5850e6616dadacdca9ab4f05e3c97a18f02d66e1
|
| 3 |
+
size 352671648
|
Quantum-X.i1-IQ4_XS.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:d9c2ed87eece078f16a5bdeda302ff806688535ccb1b7b0a6dbc3c7bba60cfbb
|
| 3 |
+
size 349403040
|
Quantum-X.i1-Q2_K.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:d28c2c63b06f26819fa47f3b1d0efbe0873f9372ce8b775238a744c9ccbf94c4
|
| 3 |
+
size 338608032
|
Quantum-X.i1-Q2_K_S.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:3411892cd2b2690f9b057cbd535c387c6ca8bea87d8c17645839d7f6a19684d7
|
| 3 |
+
size 331049376
|
Quantum-X.i1-Q3_K_L.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:335ac71a0536b63224d378985bbae1438624b0cef6248be225d7b9da47668adb
|
| 3 |
+
size 369358752
|
Quantum-X.i1-Q3_K_M.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:021d64111b8db14b0a471c0fd6077084989734ebeb3476e97005ca2f558db71e
|
| 3 |
+
size 355467168
|
Quantum-X.i1-Q3_K_S.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:611d919c047e83c0888ef6287e206ae53a93f949201ebd20774479e7ff9c3b36
|
| 3 |
+
size 338263968
|
Quantum-X.i1-Q4_0.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:06d796403cca895d61686399bc54cb434be1d54a421fe554b49957f329eba2f6
|
| 3 |
+
size 352972704
|
Quantum-X.i1-Q4_1.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:7c6e04fa9c7c6e098c226a2423420699232b57082ea6acf9aeeafc158dc1e5e6
|
| 3 |
+
size 374519712
|
Quantum-X.i1-Q4_K_M.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:09296d7346e1664385467e52fb4354003ef5a587e1274166bcb5ae4ebab33e8d
|
| 3 |
+
size 397808544
|
Quantum-X.i1-Q4_K_S.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:98c6db03958d45717c284a2bdae9ec2687f1cad70538ddf82d3f02420574c984
|
| 3 |
+
size 385472416
|
Quantum-X.i1-Q5_K_M.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:1f1be4b73134299fc15cfec404118fa92f9f461bb09db337aa73d46dd28d096b
|
| 3 |
+
size 420086688
|
Quantum-X.i1-Q5_K_S.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:0c8996190e09869f4a315390b92648461e6454ced7a34ca078b7ac2d24eac893
|
| 3 |
+
size 412710816
|
Quantum-X.i1-Q6_K.gguf
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:a01d6654e45de63898cc1817261b3d4e404dae6b6ee44302937ef3a9deafa907
|
| 3 |
+
size 505737120
|