Views
No views yet
transformers, accelerate, etc.)./gguf Folder: Quantized versions (Q4_K_M, Q5_K_M, Q8_0, etc.) for local inference via LM Studio, Ollama, or llama.cpp./adapter Folder: The raw LoRA adapter files for researchers who wish to inspect the weights or perform their own merges.1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "julienp79/occitan-gemma-3-4b-it-lora"
4
5tokenizer = AutoTokenizer.from_pretrained(model_id)
6model = AutoModelForCausalLM.from_pretrained(model_id, device_map="auto")
7
8messages = [
9 {"role": "user", "content": "Pòdes m'ajudar a escriure un pichon tèxt en occitan?"},
10]
11
12inputs = tokenizer.apply_chat_template(messages, add_generation_prompt=True, return_tensors="pt").to(model.device)
13outputs = model.generate(inputs, max_new_tokens=256)
14print(tokenizer.decode(outputs[0], skip_special_tokens=True))
15