Views
No views yet
w_bit: 4q_group_size: 128zero_point: true1from awq import AutoAWQForCausalLM
2from transformers import AutoTokenizer
3
4model = AutoAWQForCausalLM.from_quantized("Sumo10/Phi-4-mini-instruct-AWQ-4bit")
5tokenizer = AutoTokenizer.from_pretrained("Sumo10/Phi-4-mini-instruct-AWQ-4bit")
6
7input_ids = tokenizer("What is quantum computing?", return_tensors="pt").input_ids
8output = model.generate(input_ids)
9print(tokenizer.decode(output[0]))