Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_path = "TJUNLP/FuxiTranyu-8B-DPO"
4
5tokenizer = AutoTokenizer.from_pretrained(model_path, trust_remote_code=True)
6model = AutoModelForCausalLM.from_pretrained(model_path, device_map="auto", torch_dtype='auto', trust_remote_code=True)
7
8messages = [{"role": "user", "content": "This is an input text:"}]
9# format messages with the ChatML chat template
10input_ids = tokenizer.apply_chat_template(messages, tokenize=True, add_generation_prompt=True, return_tensors="pt").to(model.device)
11# <|im_start|>user\nThis is an input text:<|im_end|>\n<|im_start|>assistant\n
12
13output_ids = model.generate(input_ids, max_new_tokens=20)
14response = tokenizer.decode(output_ids[0], skip_special_tokens=True)
15
16print(response)1@article{FuxiTranyu8B,
2 title={FuxiTranyu: A Multilingual Large Language Model Trained with Balanced Data},
3 author={Haoran Sun, Renren Jin, Shaoyang Xu, Leiyu Pan, Supryadi, Menglong Cui, Jiangcun Du, Yikun Lei, Lei Yang, Ling Shi, Juesi Xiao, Shaolin Zhu, and Deyi Xiong},
4 journal={arxiv preprint arXiv:2408.06273},
5 year={2024},
6 url={https://arxiv.org/abs/2408.06273}
7}