Inference Providers
Active filters: web-llm
mlc-ai/stablelm-2-zephyr-1_6b-q4f32_1-MLC
mlc-ai/stablelm-2-zephyr-1_6b-q4f16_1-MLC
Updated • 186
mlc-ai/Qwen1.5-0.5B-Chat-q3f16_1-MLC
Updated
mlc-ai/Phi-3-mini-4k-instruct-q4f32_1-MLC
Updated • 206
mlc-ai/Llama-3-70B-Instruct-q4f16_1-MLC
Updated
mlc-ai/Phi-3-mini-128k-instruct-q0f16-MLC
Updated • 1
• 1
mlc-ai/Mistral-7B-Instruct-v0.3-q0f16-MLC
mlc-ai/Mistral-7B-Instruct-v0.3-q4f16_1-MLC
Updated • 4.27k
mlc-ai/Mistral-7B-Instruct-v0.3-q4f32_1-MLC
mlc-ai/Phi-3-mini-128k-instruct-q4f16_1-MLC
Updated • 5
• 1
mlc-ai/Phi-3-mini-128k-instruct-q4f32_1-MLC
mlc-ai/Llama-3-8B-Instruct-q4f32_1-MLC
Updated • 456
• 1
mlc-ai/Llama-3-8B-Instruct-q0f16-MLC
mlc-ai/Llama-3-8B-Instruct-q4f16_1-MLC
Updated • 418
• 7
mlc-ai/Llama-3-8B-Instruct-q3f16_1-MLC
Updated • 274
• 1
mlc-ai/Qwen1.5-0.5B-Chat-q4f32_1-MLC
mlc-ai/Qwen1.5-0.5B-Chat-q4f16_1-MLC
Updated • 140
mlc-ai/Qwen1.5-0.5B-Chat-q0f16-MLC
mlc-ai/Qwen1.5-1.8B-Chat-q4f32_1-MLC
mlc-ai/Qwen1.5-1.8B-Chat-q4f16_1-MLC
mlc-ai/Qwen1.5-1.8B-Chat-q0f16-MLC
mlc-ai/TinyLlama-1.1B-Chat-v1.0-q4f32_1-MLC
Updated • 234
mlc-ai/TinyLlama-1.1B-Chat-v1.0-q0f16-MLC
mlc-ai/Mistral-7B-Instruct-v0.3-q3f16_1-MLC
Updated • 2.5k
mlc-ai/Mixtral-8x7B-Instruct-v0.1-q4f16_1-MLC
mlc-ai/Mixtral-8x7B-Instruct-v0.1-q4f32_1-MLC
mlc-ai/Mixtral-8x7B-Instruct-v0.1-q0f16-MLC
Updated
mlc-ai/Hermes-2-Pro-Llama-3-8B-q4f32_1-MLC
mlc-ai/Hermes-2-Pro-Llama-3-8B-q4f16_1-MLC
Updated • 1.25k
mlc-ai/Hermes-2-Pro-Llama-3-8B-q0f16-MLC
Updated