Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_name = "binhphap5/gpt2-vietnamese-medium-instruct-bf16"
4
5model = AutoModelForCausalLM.from_pretrained(
6 model_name,
7 device_map="cuda:0",
8 torch_dtype = torch.bfloat16, # or float16
9)
10
11
12tokenizer = AutoTokenizer.from_pretrained(
13 model_name,
14)
15
16template = """### Instruction:
17{}
18
19### Input:
20{}
21
22### Response:
23{}"""
24
25instructions = 'Trình bày từng bước để học tiếng Anh tốt.'
26inputs = ''
27response = ''
28prompt = template.format(instructions, inputs, response)
29
30inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
31outputs = model.generate(
32 **inputs,
33 max_new_tokens=256,
34 do_sample=True,
35 temperature=0.7,
36 top_k=50,
37 top_p=0.95,
38 repetition_penalty=1.1,
39 eos_token_id=tokenizer.eos_token_id,
40 pad_token_id=tokenizer.pad_token_id,
41)
42print(tokenizer.decode(outputs[0], skip_special_tokens=False))
43
1@misc{vonwerra2022trl,
2 title = {{TRL: Transformer Reinforcement Learning}},
3 author = {Leandro von Werra and Younes Belkada and Lewis Tunstall and Edward Beeching and Tristan Thrush and Nathan Lambert and Shengyi Huang and Kashif Rasul and Quentin Gallouédec},
4 year = 2020,
5 journal = {GitHub repository},
6 publisher = {GitHub},
7 howpublished = {\url{https://github.com/huggingface/trl}}
8}