Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Qwen3-8B-W8A8 – AI Model by willteraflop | AlphaNeural AI
You can deploy this model and start earning money today!
willteraflop
/
Qwen3-8B-W8A8
like
0
transformers
safetensors
qwen3
text-generation
conversational
en
zh
open_platypus
other
autotrain_compatible
text-generation-inference
endpoints_compatible
8-bit
compressed-tensors
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Qwen3-8B-W8A8
This is a compressed version of
Qwen/Qwen3-8B
using llm-compressor with the following optimizations:
8-bit weight quantization using GPTQ
8-bit activation quantization
SmoothQuant pre-processing
Model Details
Original Model
: Qwen/Qwen3-8B
Quantization Method
: GPTQ + SmoothQuant (W8A8)
Compression Libraries
:
llm-compressor
Calibration Dataset
: open_platypus (512 samples)
Optimized For
: Inference with vLLM