Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4model = AutoModelForCausalLM.from_pretrained(
5 "austindixson/glm-4.7-flash-Opus-Reasoning",
6 device_map="auto",
7 torch_dtype=torch.bfloat16,
8)
9tokenizer = AutoTokenizer.from_pretrained("austindixson/glm-4.7-flash-Opus-Reasoning")
10
11# Generate
12prompt = "Write a function to merge two sorted lists:"
13inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
14outputs = model.generate(**inputs, max_new_tokens=256)
15print(tokenizer.decode(outputs[0], skip_special_tokens=True))1messages = [
2 {"role": "user", "content": "What is 2+2?"}
3]
4
5inputs = tokenizer.apply_chat_template(messages, tokenize=True, add_generation_prompt=True, return_tensors="pt")
6outputs = model.generate(**inputs, max_new_tokens=128)