Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Fanar-1-9B-Instruct-GPTQ – AI Model by buthainaaa | AlphaNeural AI
You can deploy this model and start earning money today!
buthainaaa
/
Fanar-1-9B-Instruct-GPTQ
like
0
safetensors
gemma2
awq
quantized
4bit
vllm
fanar
ar
en
QCRI/Fanar-1-9B-Instruct
quantized
apache-2.0
compressed-tensors
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Fanar-1-9B-Instruct-AWQ
GPTQ 4-bit quantized version of
QCRI/Fanar-1-9B-Instruct
.
Details
Quantization:
GPTQ 4-bit (w4a16)
Size:
~5GB (vs ~18GB original)
Memory:
75% reduction
Quality:
95%+ retention
Optimized for:
vLLM inference
Requirements
pip install vllm>=0.6.0
Model quantized using AutoAWQ with domain-specific calibration data.