The per-tensor scaled FP8 (E4M3) weights of Llama-3.1-8B-Instruct — a type-conversion variant (weights cast to FP8).
Stored per layer: layer_0.safetensors … layer_31.safetensors + embeddings.safetensors.
The 7 linears per layer are cast to FP8 (fp8 weight + fp32 per-tensor scale); everything else stays fp16: