Views
No views yet
run_code + workspace tools).docs/MODEL_SELECTION.md for the selection rationale.apps/sft).1import os
2import torch
3from peft import PeftModel
4from transformers import AutoModelForCausalLM, AutoTokenizer, BitsAndBytesConfig
5
6token = os.environ.get("HF_TOKEN")
7base_id = "Qwen/Qwen2.5-Coder-7B-Instruct"
8adapter_id = "nabin2004/AOS-qwen25-coder-7b-manim-sft"
9
10bnb = BitsAndBytesConfig(
11 load_in_4bit=True,
12 bnb_4bit_use_double_quant=True,
13 bnb_4bit_quant_type="nf4",
14 bnb_4bit_compute_dtype=torch.bfloat16,
15)
16
17base = AutoModelForCausalLM.from_pretrained(
18 base_id,
19 quantization_config=bnb,
20 device_map="auto",
21 torch_dtype=torch.bfloat16,
22 token=token,
23)
24model = PeftModel.from_pretrained(base, adapter_id, token=token)
25tokenizer = AutoTokenizer.from_pretrained(adapter_id, token=token)
26model.eval()1cd apps/sft
2uv run python infer.py \
3 --adapter-dir nabin2004/AOS-qwen25-coder-7b-manim-sft \
4 --prompt "Create a short Manim scene explaining eigenvectors in 2D."