Views
No views yet
transformers)adapter/ Folder: The raw DoRA adapter files (for use with PEFT)gguf/ Folder: Quantized GGUF versions (f16, Q2_K, Q4_K_M, Q5_K_M, Q8_0) for local inference via llama.cpp, LM Studio, Ollama, etc.1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "julienp79/occitan-gemma-3-4b-it-dora-sfttrainer"
4
5tokenizer = AutoTokenizer.from_pretrained(model_id)
6model = AutoModelForCausalLM.from_pretrained(model_id, device_map="auto")
7
8messages = [
9 {"role": "user", "content": "Escrivètz un cort paragraf en occitan sus la lenga occitana e son importància."},
10]
11
12inputs = tokenizer.apply_chat_template(messages, add_generation_prompt=True, return_tensors="pt").to(model.device)
13outputs = model.generate(inputs, max_new_tokens=256)
14print(tokenizer.decode(outputs[0], skip_special_tokens=True))1from peft import PeftModel
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4base_model = AutoModelForCausalLM.from_pretrained(
5 "unsloth/gemma-3-4b-it",
6 device_map="auto",
7 torch_dtype="auto"
8)
9tokenizer = AutoTokenizer.from_pretrained("unsloth/gemma-3-4b-it")
10
11# Load adapter from the adapter/ subfolder
12model = PeftModel.from_pretrained(base_model, "julienp79/occitan-gemma-3-4b-it-dora-sfttrainer", subfolder="adapter")
13model.eval()
14
15prompt = tokenizer.apply_chat_template(
16 [{"role": "user", "content": "Sètz un assistent utila que parla occitan."}],
17 tokenize=False,
18 add_generation_prompt=True
19)
20inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
21outputs = model.generate(**inputs, max_new_tokens=128)
22print(tokenizer.decode(outputs[0], skip_special_tokens=True))1llama-cli -hf julienp79/occitan-gemma-3-4b-it-dora-sfttrainer:Q4_K_M \
2 -p "<start_of_turn>user\nEscrivètz un cort paragraf en occitan.<end_of_turn>\n<start_of_turn>model\n" \
3 -n 256 -e --temp 0.71llama-cli -m gguf/occitan-gemma-3-4b-it-dora-sfttrainer-Q4_K_M.gguf \
2 -p "<start_of_turn>user\nEscrivètz un cort paragraf en occitan.<end_of_turn>\n<start_of_turn>model\n" \
3 -n 256 -e --temp 0.7use_dora=True)