QLoRA adapter for InternVL3-8B fine-tuned on RoboVQA for multi-turn robotics reasoning.
Initialized from Stage 1 checkpoint, trained on DGX Spark (GB10 Blackwell, 128GB unified memory) for ~17 days.
1from peft import PeftModel
2from transformers import AutoModel
3
4base_model = AutoModel.from_pretrained("OpenGVLab/InternVL3-8B", trust_remote_code=True)
5model = PeftModel.from_pretrained(base_model, "agiri123/internvl3-8b-robovqa-stage2")
See the repository README for full training details, hyperparameters, and curriculum validation experiments.