Views
No views yet
unsloth/Llama-3.2-11B-Vision-Instructunsloth/Radiology_mini1from unsloth import FastVisionModel
2
3model, tokenizer = FastVisionModel.from_pretrained(
4 "Hnm_Llama3.2_(11B)-Vision_lora_model",
5 load_in_4bit=True # Set to False for full precision
6)1import torch
2from transformers import TextStreamer
3
4FastVisionModel.for_inference(model) # Enable inference mode
5
6# Load an image from dataset
7dataset = load_dataset("unsloth/Radiology_mini", split="train")
8image = dataset[0]["image"]
9instruction = "Describe this medical image accurately."
10
11messages = [
12 {"role": "user", "content": [
13 {"type": "image"},
14 {"type": "text", "text": instruction}
15 ]}
16]
17
18input_text = tokenizer.apply_chat_template(messages, add_generation_prompt=True)
19inputs = tokenizer(
20 image,
21 input_text,
22 add_special_tokens=False,
23 return_tensors="pt"
24).to("cuda")
25
26text_streamer = TextStreamer(tokenizer, skip_prompt=True)
27_ = model.generate(**inputs, streamer=text_streamer, max_new_tokens=128,
28 use_cache=True, temperature=1.5, min_p=0.1)@misc{Hnm_Llama3.2_11B_Vision,
author = {Haq Nawaz Malik},
title = {Fine-tuned Llama 3.2 (11B) Vision Model},
year = {2025},
url = {https://huggingface.co/Omarrran/Hnm_Llama3_2_Vision_lora_model}
}