Views
No views yet
| Tensor | Source | Target |
|---|---|---|
ffn.experts.*.{w1,w2,w3} | int8 (FP4) + E8M0 scale | F8_E4M3 + F32 scale |
attn.*, shared_experts.*, mtp.*.e_proj | F8_E4M3 + E8M0 scale | F8_E4M3 + F32 scale (weight unchanged) |
attn.wo_a.weight | F8_E4M3 + E8M0 scale | BF16 (scale absorbed) |
attn.wo_a.scale | E8M0 | dropped |
| norms, embed, gate, etc. | BF16 / F32 | unchanged |