Legal Chatbot SLM Indonesian (16-bit / QLoRA Fine-Tuned)
Model ini adalah Small Language Model (SLM) hasil fine-tuning dan GRPO Reinforcement Learning untuk tugas asisten tanya-jawab tim legal di Indonesia berbasis Qwen 2.5 7B Instruct.
Informasi Model:
Base Model: unsloth/Qwen2.5-Coder-7B-Instruct-bnb-4bit