Views
No views yet
.weight: INT8 quantized weights.weight_scale: BF16 scale parameters (trainable)1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3# Note: This requires custom quantization code to load properly
4model = AutoModelForCausalLM.from_pretrained("DESUCLUB/Llama-3.1-8B-Instruct-quantized.w8a8")
5tokenizer = AutoTokenizer.from_pretrained("DESUCLUB/Llama-3.1-8B-Instruct-quantized.w8a8")