Views
No views yet
google/gemma-3-1b-it, fine-tuned with LoRA. Fluent Hindi on edge hardware — CPU, Ollama, Raspberry Pi.1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3tok = AutoTokenizer.from_pretrained("pankajpandey-dev/gemma-3-1b-hindi-instruct")
4model = AutoModelForCausalLM.from_pretrained("pankajpandey-dev/gemma-3-1b-hindi-instruct", torch_dtype=torch.float32)
5msgs = [{"role": "user", "content": "एक छोटे बच्चे को गुरुत्वाकर्षण सरल हिंदी में समझाइए।"}]
6inputs = tok.apply_chat_template(msgs, add_generation_prompt=True, return_tensors="pt")
7out = model.generate(inputs, max_new_tokens=256, temperature=0.4, top_p=0.9, repetition_penalty=1.3)
8print(tok.decode(out[0][inputs.shape[1]:], skip_special_tokens=True))| Repo | Format | Use |
|---|---|---|
...-hindi-instruct | Merged 16-bit | Transformers |
...-hindi-instruct-GGUF | Q4_K_M / Q5_K_M / Q8_0 | Ollama, llama.cpp, CPU |
...-hindi-instruct-lora | LoRA adapter | Method artifact |
google/gemma-3-1b-it (text-only path)indic-instruct-data-v0.1 — anudesh + dolly (Hindi), chrF≥50 filtered, balanced 6ktemperature=0.4, top_p=0.9, repetition_penalty=1.3.प्रश्न: एक छोटे बच्चे को गुरुत्वाकर्षण सरल हिंदी में समझाइए। उत्तर: PASTE_YOUR_BEST_CLEAN_OUTPUT_HERE