Views
No views yet
nano_compact/.1from transformers import AutoModelForCausalLM, AutoTokenizer
2repo_id = "RthItalia/NanoLLM-Qwen2.5-7B-v3.1"
3tokenizer = AutoTokenizer.from_pretrained(repo_id, subfolder="nano_compact", use_fast=True)
4model = AutoModelForCausalLM.from_pretrained(repo_id, subfolder="nano_compact", trust_remote_code=True, device_map="auto")nano_compact/model.safetensors contains Nano quantized tensors and does not require downloading the Qwen base weights.