Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained(
4 "2imi9/qwen3-1.7b-gptq-int4",
5 device_map="auto",
6 trust_remote_code=True
7)
8tokenizer = AutoTokenizer.from_pretrained("2imi9/qwen3-1.7b-gptq-int4")
9
10# Generate text
11inputs = tokenizer("Hello, how are you?", return_tensors="pt")
12outputs = model.generate(**inputs, max_new_tokens=50)
13print(tokenizer.decode(outputs[0], skip_special_tokens=True))1import gradio as gr
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4model = AutoModelForCausalLM.from_pretrained("2imi9/qwen3-1.7b-gptq-int4", device_map="auto")
5tokenizer = AutoTokenizer.from_pretrained("2imi9/qwen3-1.7b-gptq-int4")
6
7def chat(message, history):
8 inputs = tokenizer(message, return_tensors="pt")
9 outputs = model.generate(**inputs, max_new_tokens=100, temperature=0.7)
10 response = tokenizer.decode(outputs[0][inputs.input_ids.shape[1]:], skip_special_tokens=True)
11 return response
12
13gr.ChatInterface(chat).launch()