Views
No views yet
Hindi.csvEnglish text: Contains English sentences.Colloquial text: Corresponding Hinglish translations.ISO-8859-1transformers library with the following configuration:gpt2 from Hugging Face)eos_token as padding token34 (train), 8 (eval)5000.01epochepochpip install transformers datasets torch pandasDataset format../fine_tuned_gpt2_hinglish directory.1from transformers import GPT2Tokenizer, GPT2LMHeadModel
2
3tokenizer = GPT2Tokenizer.from_pretrained("./fine_tuned_gpt2_hinglish")
4model = GPT2LMHeadModel.from_pretrained("./fine_tuned_gpt2_hinglish")
5
6def generate_hinglish(text):
7 inputs = tokenizer(text, return_tensors="pt")
8 outputs = model.generate(**inputs, max_length=50)
9 return tokenizer.decode(outputs[0], skip_special_tokens=True)
10
11print(generate_hinglish("Hello, how are you?"))transformers and datasets libraries along with PyTorch for model training and fine-tuning.