Views
No views yet
1 vocab_size = 193856
2 model = transformers.AutoModelForCausalLM.from_pretrained(
3 "meta-llama/Llama-3.2-1B-Instruct",
4 torch_dtype=torch.bfloat16,
5 attn_implementation="flash_attention_2")
6
7 # Resize token embeddings
8 model.resize_token_embeddings(vocab_size)
9 model.vocab_size = vocab_size