Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Jan-nano-128k-W8A8 – AI Model by dolfsai | AlphaNeural AI
You can deploy this model and start earning money today!
dolfsai
/
Jan-nano-128k-W8A8
like
0
safetensors
qwen3
vllm
gptq
agentic
text-generation
conversational
en
es
HuggingFaceH4/ultrachat_200k
Menlo/Jan-nano-128k
quantized
apache-2.0
8-bit
compressed-tensors
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
dolfsai/Jan-nano-128k-W8A8
This is a compressed version of Menlo/Jan-nano-128k using llm-compressor with the following scheme: W8A8 Usage instructions and details
here
Model Details
Original Model
: Menlo/Jan-nano-128k
Quantization Method
: GPTQ
Compression Libraries
:
llm-compressor
Calibration Dataset
: ultrachat_200k (1024 samples)
Optimized For
: Inference with vLLM
License
: same as original model