Views
No views yet
WanModel architecture, specifically targeting its attention and feed-forward layers.safetensors Export: Saves the quantized model weights in the safetensors format for efficient loading.1from wan_2_1_fp8_quantizer import FP8Quantizer, WanModel
2model = WanModel.from_pretrained("Anisora_V3_1/V3.1")
3
4quantizer = FP8Quantizer()
5state_dict = model.state_dict()
6quantized_state_dict = quantizer.apply_quantization(state_dict)
7
8from safetensors.torch import save_file
9save_file(quantized_state_dict,"Anisora_V3_1_fp8_e5m2.safetensors")