Views
No views yet
Polygl0t/Tucano2-qwen-1.5B-Instruct, fine-tuned for short Brazilian Portuguese role-play conversations.Polygl0t/Tucano2-qwen-1.5B-Instruct| Model | Good | Partial | Bad | Peak CUDA VRAM |
|---|---|---|---|---|
| 1.5B Instruct original FP16 | 9/30 | 16/30 | 5/30 | n/a |
| 1.5B Instruct + LoRA FP16 | 15/30 | 9/30 | 6/30 | 2.9 GB |
| 1.5B Instruct original 4-bit NF4 | 5/30 | 13/30 | 12/30 | 1.44 GB |
| 1.5B Instruct + LoRA 4-bit NF4 | 16/30 | 11/30 | 3/30 | 1.44 GB |
| 3.7B Instruct original 4-bit NF4 | 13/30 | 12/30 | 5/30 | 3.6 GB |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base_model = "Polygl0t/Tucano2-qwen-1.5B-Instruct"
5adapter = "YOUR_USERNAME/tucano2-1p5b-ptbr-roleplay-lora-9k"
6
7tokenizer = AutoTokenizer.from_pretrained(base_model)
8model = AutoModelForCausalLM.from_pretrained(base_model, device_map="auto")
9model = PeftModel.from_pretrained(model, adapter)
10model.eval()