Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Apertus-8B-Instruct-2509-SPINQUANT-FP8_dynamic – AI Model by sevri | AlphaNeural AI
You can deploy this model and start earning money today!
sevri
/
Apertus-8B-Instruct-2509-SPINQUANT-FP8_dynamic
like
0
safetensors
apertus
quantization
llm
swissai
swiss-ai/Apertus-8B-Instruct-2509
quantized
compressed-tensors
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Apertus-8B-Instruct-2509-SPINQUANT-FP8_dynamic
This is an FP8 dynamically quantized version of
swiss-ai/Apertus-8B-Instruct-2509
using
llm-compressor
.
It additionally uses the SpinQuant transformation to improve quantization performance.
Quantization Details
Quantization Scheme
: FP8_dynamic
Transformation
: SpinQuant with Hadamard rotations (R1 & R2)
Method
: Dynamic quantization of weights and activations to FP8 format
Targets
: All Linear layers
Ignored Layers
:
lm_head
(kept in higher precision for better output quality)
Tool
: llm-compressor