Views
No views yet
transformers or serve with vLLM. No adapter stacking
required.oro-ai/sn15-shoppingbench-sft-15koro-ai/sn15-shoppingbench-traces-18k1from transformers import AutoModelForCausalLM, AutoTokenizer
2tok = AutoTokenizer.from_pretrained("oro-ai/qwen3-4b-shoppingbench-kto")
3model = AutoModelForCausalLM.from_pretrained("oro-ai/qwen3-4b-shoppingbench-kto", torch_dtype="bfloat16", device_map="auto")