Views
No views yet
1from unsloth import FastLanguageModel
2import torch
3
4# Load model
5model, tokenizer = FastLanguageModel.from_pretrained(
6 model_name="dtadpole/KernelCoder-32B_20250621-013349",
7 max_seq_length=32768,
8 dtype=None,
9 load_in_4bit=True,
10)
11
12# Enable inference mode
13FastLanguageModel.for_inference(model)
14
15# Format your prompt
16messages = [
17 {"role": "system", "content": "You are a helpful assistant."},
18 {"role": "user", "content": "Your question here"}
19]
20
21formatted_prompt = tokenizer.apply_chat_template(
22 messages,
23 tokenize=False,
24 add_generation_prompt=True
25)
26
27# Generate
28inputs = tokenizer(formatted_prompt, return_tensors="pt")
29outputs = model.generate(**inputs, max_new_tokens=256, temperature=0.7)
30response = tokenizer.decode(outputs[0], skip_special_tokens=True)
31print(response)