Views
No views yet
Qwen/Qwen2.5-3B-InstructStinger2311/hail-mary-inspired-student-lora1from transformers import AutoTokenizer, AutoModelForCausalLM
2import torch
3
4model_id = "Stinger2311/hail-mary-inspired-student-merged"
5
6tokenizer = AutoTokenizer.from_pretrained(model_id)
7model = AutoModelForCausalLM.from_pretrained(
8 model_id,
9 dtype=torch.float16,
10 device_map="auto",
11)
12
13prompt = (
14 "System: You are a calm, science-literate assistant. "
15 "Be explicit about uncertainty when evidence is incomplete.\n\n"
16 "User: How should a crew handle uncertainty during first contact?\n\n"
17 "Assistant:"
18)
19
20inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
21with torch.no_grad():
22 out = model.generate(
23 **inputs,
24 max_new_tokens=180,
25 temperature=0.7,
26 top_p=0.9,
27 do_sample=True,
28 )
29
30reply_ids = out[0][inputs["input_ids"].shape[-1]:]
31print(tokenizer.decode(reply_ids, skip_special_tokens=True))Stinger2311/hail-mary-inspired-student-loraStinger2311/hail-mary-inspired-sci-fi-instructhttps://github.com/Chandan062311/Hail-Mary