Views
No views yet
pip install datasets transformers torch sentencepiece1from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
2
3model_name = "hou000123/zh2yue-translation"
4tokenizer = AutoTokenizer.from_pretrained(model_name)
5model = AutoModelForSeq2SeqLM.from_pretrained(model_name)
6def translate_to_cantonese(text):
7 inputs = tokenizer(text, return_tensors="pt", padding=True, truncation=True)
8 outputs = model.generate(**inputs)
9 return tokenizer.decode(outputs[0], skip_special_tokens=True)
10
11print(translate_to_cantonese("今天天气很好")) # 输出: "今日天氣好好"```