Views
No views yet
Qwen/Qwen2.5-3B-Instruct + SagaLM LoRA training.from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained("venkateshchsagalm/SagaLM-slm1-merged", device_map="auto")
tokenizer = AutoTokenizer.from_pretrained("venkateshchsagalm/SagaLM-slm1-merged")model.generate(**inputs, max_new_tokens=2048, min_new_tokens=250,
temperature=0.7, top_p=0.9, repetition_penalty=1.1,
do_sample=True)