Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4model = AutoModelForCausalLM.from_pretrained(
5 "FrontierInstruments/finetuning_llama_grpo_full_8gpu_1000steps",
6 torch_dtype=torch.float16,
7 device_map="auto"
8)
9tokenizer = AutoTokenizer.from_pretrained("FrontierInstruments/finetuning_llama_grpo_full_8gpu_1000steps")
10
11# Generate text
12inputs = tokenizer("Your prompt here", return_tensors="pt")
13with torch.no_grad():
14 outputs = model.generate(**inputs, max_new_tokens=512, temperature=0.7)
15print(tokenizer.decode(outputs[0], skip_special_tokens=True))