The 29M-parameter LoRA adapter (r=16) behind
pankajpandey-dev/qwen3.5-9b-hindi-instruct. Attach to base Qwen3.5-9B, or use as a starting point for your own Indic fine-tunes.
1from peft import PeftModel
2from transformers import AutoModelForCausalLM
3base = AutoModelForCausalLM.from_pretrained("unsloth/Qwen3.5-9B", torch_dtype="bfloat16", device_map="auto")
4model = PeftModel.from_pretrained(base, "pankajpandey-dev/qwen3.5-9b-hindi-instruct-lora")
Full recipe, data mix and limitations: see the
main model card.
Weekly open releases making small LLMs speak fluent, native Hindi — trained on free/low-cost GPUs, shipped as GGUF for laptops and edge devices. Built by
pankajpandey-dev (contact links on profile).