This repository provides a LoRA adapter fine-tuned from
kuririrn/qwen3-4b-agent-trajectory_alf_admissible-lora-constraint_gen-dist_allign using LoRA + Unsloth.
This repository contains LoRA adapter weights only.
The base model must be loaded separately.
Datasets
This adapter is trained on a single trajectory-style SFT dataset: