Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Danielrahmai1991_-_nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit-gguf – AI Model by RichardErkhov | AlphaNeural AI
You can deploy this model and start earning money today!
RichardErkhov
/
Danielrahmai1991_-_nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit-gguf
like
0
endpoints_compatible
gguf
template
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Quantization made by Richard Erkhov.
Github
Discord
Request more models
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit - GGUF
Model creator:
https://huggingface.co/Danielrahmai1991/
Original model:
https://huggingface.co/Danielrahmai1991/nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit/
Name
Quant method
Size
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q2_K.gguf
Q2_K
1.76GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q3_K_S.gguf
Q3_K_S
2.02GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q3_K.gguf
Q3_K
2.18GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q3_K_M.gguf
Q3_K_M
2.18GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q3_K_L.gguf
Q3_K_L
2.32GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.IQ4_XS.gguf
IQ4_XS
2.42GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q4_0.gguf
Q4_0
2.51GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.IQ4_NL.gguf
IQ4_NL
2.53GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q4_K_S.gguf
Q4_K_S
2.53GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q4_K.gguf
Q4_K
2.63GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q4_K_M.gguf
Q4_K_M
2.63GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q4_1.gguf
Q4_1
2.75GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q5_0.gguf
Q5_0
2.98GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q5_K_S.gguf
Q5_K_S
2.98GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q5_K.gguf
Q5_K
3.04GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q5_K_M.gguf
Q5_K_M
3.04GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q5_1.gguf
Q5_1
3.21GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q6_K.gguf
Q6_K
3.48GB
nvidia_Llama-3.1-Minitron-4B-Depth-Base_adapt_basic_model_16bit.Q8_0.gguf
Q8_0
3.05GB
Original model description:
base_model: nvidia/Llama-3.1-Minitron-4B-Depth-Base language:
en license: apache-2.0 tags:
text-generation-inference
transformers
unsloth
llama
trl
Uploaded model
Developed by:
Danielrahmai1991
License:
apache-2.0
Finetuned from model :
nvidia/Llama-3.1-Minitron-4B-Depth-Base
This llama model was trained 2x faster with
Unsloth
and Huggingface's TRL library.