Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained(
4 "cylnx/qwen3-8b-lora-Opus4.6-resoning",
5 torch_dtype="auto",
6 device_map="auto",
7 trust_remote_code=True
8)
9tokenizer = AutoTokenizer.from_pretrained("cylnx/qwen3-8b-lora-Opus4.6-resoning", trust_remote_code=True)
10
11messages = [{"role": "user", "content": "Your question here"}]
12inputs = tokenizer.apply_chat_template(messages, tokenize=True, return_tensors="pt").to(model.device)
13outputs = model.generate(inputs, max_new_tokens=512)
14print(tokenizer.decode(outputs[0]))