Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Apertus-8B-Instruct-2509-FP8-BLOCK – AI Model by jgerster0 | AlphaNeural AI
You can deploy this model and start earning money today!
jgerster0
/
Apertus-8B-Instruct-2509-FP8-BLOCK
like
0
safetensors
apertus
compressed-tensors
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Apertus-8B-Instruct-2509-FP8-BLOCK
This is an FP8 block-wise quantized version of
swiss-ai/Apertus-8B-Instruct-2509
using
llm-compressor
.
Quantization Details
Quantization Scheme
: FP8_BLOCK
Method
: Block-wise FP8 quantization of weights (per-block, static)
Targets
: All Linear layers
Ignored Layers
:
lm_head
,
mlp.gate
(kept in higher precision for better output quality)
Tool
: llm-compressor