Views
No views yet
/README.md
/config.json
/tokenizer.json
/adapter_config.json
/adapter_model.bin
/training_logs/1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_name = "<your-hf-username>/<your-model-repo>"
4tokenizer = AutoTokenizer.from_pretrained(model_name)
5model = AutoModelForCausalLM.from_pretrained(model_name, device_map="auto")
6
7prompt = "Explain QLoRA in one sentence."
8inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
9
10output = model.generate(**inputs, max_new_tokens=80)
11print(tokenizer.decode(output[0], skip_special_tokens=True))README.md