serverdaun-smollm3-dpo.F16.Q4_K_M.gguf
Overview (EN)
This repository provides a q4_k_m-quantized GGUF file derived from serverdaun/smollm3-dpo.
Quick Start (llama.cpp)
./build/bin/llama-cli -m serverdaun-smollm3-dpo.F16.Q4_K_M.gguf -p "Hello"
Quantization
- Format: GGUF
- Method: q4_k_m
- File:
serverdaun-smollm3-dpo.F16.Q4_K_M.gguf - Size: ~1.78 GB
Provenance
- Base model:
serverdaun/smollm3-dpo
Note: This repo contains inference-only quantized weights. Respect the upstream license and usage terms.
Présentation (FR)
Ce dépôt fournit un fichier GGUF q4_k_m issu de serverdaun/smollm3-dpo.
Démarrage rapide (llama.cpp)
./build/bin/llama-cli -m serverdaun-smollm3-dpo.F16.Q4_K_M.gguf -p "Bonjour"
Quantification
- Format : GGUF
- Méthode : q4_k_m
- Fichier :
serverdaun-smollm3-dpo.F16.Q4_K_M.gguf - Taille : ~1.78 Go
Provenance
- Modèle amont :
serverdaun/smollm3-dpo
Remarque : Ce dépôt contient uniquement des poids quantifiés pour l'inférence. Merci de respecter la licence et les conditions d'utilisation du modèle d'origine.
- Downloads last month
- 25
Hardware compatibility
Log In
to view the estimation
4-bit
Inference Providers
NEW
This model isn't deployed by any Inference Provider.
🙋
Ask for provider support
Model tree for ramgpt/smollm3-dpo-GGUF-Q4_K_M
Base model
HuggingFaceTB/SmolLM3-3B-Base
Finetuned
HuggingFaceTB/SmolLM3-3B
Finetuned
serverdaun/smollm3-dpo