Views
No views yet

1pip install --upgrade pip
2pip install transformers>=4.39.01from transformers import LlavaNextProcessor, LlavaNextForConditionalGeneration
2import torch
3
4device = torch.device('cuda' if torch.cuda.is_available() else 'cpu')
5processor = LlavaNextProcessor.from_pretrained("torilab/casktalk-vlm-v1.0")
6model = LlavaNextForConditionalGeneration.from_pretrained(
7 "torilab/casktalk-vlm-v1.0",
8 torch_dtype=torch.float16,
9 low_cpu_mem_usage=True
10)
11model.to(device)
121from PIL import Image
2import requests
3
4url = "<your_user_image>"
5image = Image.open(requests.get(url, stream=True).raw)
6prompt = "[INST] <image>\nWhat is shown in this image? [/INST]"
7
8inputs = processor(prompt, image, return_tensors="pt").to(device)
9output = model.generate(**inputs, max_new_tokens=100)print(processor.decode(output[0], skip_special_tokens=True))