Views
No views yet
enable_thinking=false)1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "modrill/qwen3-4b-nothink-baseline-lora-sft"
4tok = AutoTokenizer.from_pretrained(model_id, trust_remote_code=True)
5model = AutoModelForCausalLM.from_pretrained(
6 model_id, trust_remote_code=True, torch_dtype="auto", device_map="auto"
7)enable_thinking=false in chat templatemax_tokens: 8192