Views
No views yet
| Parameter | Value |
|---|---|
| Base model | mistralai/Mistral-7B-v0.3 |
| Dataset | Bitext customer support (26k examples) |
| Method | QLoRA (4-bit NF4 + LoRA rank=16) |
| Hardware | NVIDIA T4 16GB (Google Colab free tier) |
| Precision | fp16 (T4 compatible) |
| Max steps | 500 |
| Effective batch | 16 (2 × grad_accum 8) |
| Learning rate | 2e-4 cosine |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4model_id = "AyeshaImtiaz/supportsphere-mistral-support"
5tokenizer = AutoTokenizer.from_pretrained(model_id)
6model = AutoModelForCausalLM.from_pretrained(model_id, torch_dtype=torch.float16, device_map="auto")
7
8prompt = "<s>[INST] I want to return my order and get a refund. [/INST]"
9inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
10output = model.generate(**inputs, max_new_tokens=150, temperature=0.3, do_sample=True)
11print(tokenizer.decode(output[0], skip_special_tokens=True))