Views
No views yet
TinyLlama/TinyLlama-1.1B-intermediate-step-1431k-3T
to answer factual questions about AWS EC2 instance specifications — API names,
compute family, memory, vCPU counts, and on-demand hourly pricing.TinyLlama/TinyLlama-1.1B-intermediate-step-1431k-3T1import torch
2from transformers import AutoModelForCausalLM, AutoTokenizer
3from peft import PeftModel
4
5BASE_ID = "TinyLlama/TinyLlama-1.1B-intermediate-step-1431k-3T"
6ADAPTER = "./tinyllama-ec2-lora"
7
8tokenizer = AutoTokenizer.from_pretrained(ADAPTER)
9base = AutoModelForCausalLM.from_pretrained(
10 BASE_ID,
11 torch_dtype=torch.float16,
12 device_map="auto",
13)
14model = PeftModel.from_pretrained(base, ADAPTER)
15model.eval()
16
17prompt = "Question: What is the API name for A1 Large?\nAnswer:"
18inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
19out = model.generate(
20 **inputs,
21 max_new_tokens=120,
22 do_sample=False,
23 pad_token_id=tokenizer.eos_token_id,
24)
25print(tokenizer.decode(out[0], skip_special_tokens=True))