Views
No views yet
1import requests
2from PIL import Image
3
4import torch
5from transformers import AutoProcessor, LlavaForConditionalGeneration
6
7model_id = "vonjack/Nous-Hermes-2-Pro-Xtuner-LLaVA-v1_1-Llama-3-8B"
8
9prompt = ("<|im_start|>user\n<image>\nWhat are these?<|im_end|>"
10 "<|im_start|>assistant\n")
11image_file = "http://images.cocodataset.org/val2017/000000039769.jpg"
12
13model = LlavaForConditionalGeneration.from_pretrained(
14 model_id,
15 torch_dtype=torch.float16,
16 low_cpu_mem_usage=True,
17).to(0)
18
19processor = AutoProcessor.from_pretrained(model_id)
20
21
22raw_image = Image.open(requests.get(image_file, stream=True).raw)
23inputs = processor(prompt, raw_image, return_tensors='pt').to(0, torch.float16)
24
25output = model.generate(**inputs, max_new_tokens=200, do_sample=False)
26print(processor.decode(output[0][2:], skip_special_tokens=True))