Views
No views yet
bitsandbytes quantization config was used during training:1from peft import PeftModel, PeftConfig
2from transformers import AutoModelForCausalLM
3
4config = PeftConfig.from_pretrained("matheusrdgsf/cesar-ptbr")
5model = AutoModelForCausalLM.from_pretrained("TheBloke/zephyr-7B-beta-GPTQ", revision="gptq-8bit-32g-actorder_True", device_map='auto')
6model = PeftModel.from_pretrained(model, "matheusrdgsf/cesar-ptbr")1from transformers import GenerationConfig
2from transformers import AutoTokenizer
3
4tokenizer_model = AutoTokenizer.from_pretrained('TheBloke/zephyr-7B-beta-GPTQ')
5tokenizer_template = AutoTokenizer.from_pretrained('HuggingFaceH4/zephyr-7b-alpha')
6
7generation_config = GenerationConfig(
8 do_sample=True,
9 temperature=0.1,
10 top_p=0.25,
11 top_k=0,
12 max_new_tokens=512,
13 repetition_penalty=1.1,
14 eos_token_id=tokenizer_model.eos_token_id,
15 pad_token_id=tokenizer_model.eos_token_id,
16)
17
18
19def get_inference(
20 text,
21 model,
22 tokenizer_model=tokenizer_model,
23 tokenizer_template=tokenizer_template,
24 generation_config=generation_config,
25):
26 st_time = time.time()
27 inputs = tokenizer_model(
28 tokenizer_template.apply_chat_template(
29 [
30 {
31 "role": "system",
32 "content": "Você é um chatbot para indicação de filmes. Responda em português e de maneira educada sugestões de filmes para os usuários.",
33 },
34 {"role": "user", "content": text},
35 ],
36 tokenize=False,
37 ),
38 return_tensors="pt",
39 ).to("cuda")
40
41 outputs = model.generate(**inputs, generation_config=generation_config)
42
43 print('inference time:', time.time() - st_time)
44 return tokenizer_model.decode(outputs[0], skip_special_tokens=True).split('\n')[-1]
45
46get_inference('Poderia indicar filmes de ação de até 2 horas?', model)| Metric | Value |
|---|---|
| Average | 59.22 |
| ENEM Challenge (No Images) | 53.74 |
| BLUEX (No Images) | 46.87 |
| OAB Exams | 38.27 |
| Assin2 RTE | 58.32 |
| Assin2 STS | 68.49 |
| FaQuAD NLI | 73.81 |
| HateBR Binary | 83.30 |
| PT Hate Speech Binary | 67.49 |
| tweetSentBR | 42.71 |