Views
No views yet
AutoModelForCausalLM as shown below:1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "Aratako/Ministral-3-14B-Instruct-2512-TextOnly"
4
5tokenizer = AutoTokenizer.from_pretrained(model_id)
6model = AutoModelForCausalLM.from_pretrained(
7 model_id,
8 device_map="cuda",
9)
10
11messages = [
12 {
13 "role": "user",
14 "content": "Tell me a joke about computers.",
15 },
16]
17
18input_ids = tokenizer.apply_chat_template(messages, return_tensors="pt").to("cuda")
19
20output = model.generate(
21 input_ids, max_new_tokens=512, pad_token_id=tokenizer.eos_token_id
22)
23
24decoded_output = tokenizer.decode(
25 output[0][len(input_ids[0]) :], skip_special_tokens=True
26)
27print(decoded_output)