Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4model_id = "DuoNeural/Granite-4.1-3B-Abliterated"
5tokenizer = AutoTokenizer.from_pretrained(model_id)
6model = AutoModelForCausalLM.from_pretrained(model_id, torch_dtype=torch.bfloat16, device_map="auto")
7
8messages = [{"role": "user", "content": "Your prompt here"}]
9text = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
10inputs = tokenizer(text, return_tensors="pt").to(model.device)
11outputs = model.generate(**inputs, max_new_tokens=512)
12print(tokenizer.decode(outputs[0][inputs.input_ids.shape[-1]:], skip_special_tokens=True))| Platform | Link |
|---|---|
| HuggingFace | huggingface.co/DuoNeural |
| Website | duoneural.com |
| GitHub | github.com/DuoNeural |
| X / Twitter | @DuoNeural |
| duoneural@proton.me | |
| Newsletter | duoneural.beehiiv.com |
| Support | buymeacoffee.com/duoneural |