Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer, TextStreamer
2from unsloth import FastLanguageModel
3
4model_name="wesjos/SFT-Qwen3-8B-alpaca"
5
6tokenizer = AutoTokenizer.from_pretrained(model_name,trust_remote_code=True)
7model = AutoModelForCausalLM.from_pretrained(
8 model_name,
9 torch_dtype="auto",
10 device_map="auto",
11 trust_remote_code=True,
12)
13alpaca_prompt = """Below is an instruction that describes a task. Write a response that appropriately completes the request.
14
15### Instruction:
16{}
17
18### Response:
19"""
20
21inputs = tokenizer(
22[
23 alpaca_prompt.format(
24 "请你介绍一下自己", # instruction
25 )
26], return_tensors = "pt").to("cuda")
27
28outputs = model.generate(**inputs, max_new_tokens=1024, use_cache=True,temperature=0.9,do_sample=True,top_p=0.95,top_k=20)
29print(tokenizer.batch_decode(outputs)[0])