Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "ghzlmc/nemotron-3-nano-30b-unified"
4tokenizer = AutoTokenizer.from_pretrained(model_id, trust_remote_code=True)
5model = AutoModelForCausalLM.from_pretrained(
6 model_id,
7 torch_dtype="auto",
8 device_map="auto",
9 trust_remote_code=True,
10)nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 with TRL SFT and exported as merged safetensors shards.trust_remote_code=True.