Views
No views yet
./results4410.3fp16=False, bf16=Falsepaged_adamw_32bit2e-50.001cosine0.03-1 (determined by epochs)use_4bit = Truebnb_4bit_compute_dtype = float16bnb_4bit_quant_type = nf4use_nested_quant = Falselora_r = 64lora_alpha = 16lora_dropout = 0.05max_seq_length=None)packing=False){"": 0}1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_name = "HiTruong/Llama-2-chat-finetuned"
4tokenizer = AutoTokenizer.from_pretrained(model_name)
5model = AutoModelForCausalLM.from_pretrained(model_name)
6
7def generate_answer(question):
8 inputs = tokenizer(f"<s>[INST] {question} [/INST]", return_tensors="pt", truncation=True, max_length=100).to(model.device)
9 with torch.no_grad():
10 output = model.generate(**inputs, max_length=75, eos_token_id=tokenizer.eos_token_id)
11 response = tokenizer.decode(output[0], skip_special_tokens=True, clean_up_tokenization_spaces=True)
12 return response.replace(f"[INST] {question} [/INST]", "").strip().split('.')[0]
13
14input_text = "What are some great sci-fi movies?"
15
16print(generate_answer(input_text))