Views
No views yet
pip install git+https://github.com/huggingface/transformers.git1import torch
2from PIL import Image
3from transformers import (
4 AutoTokenizer,
5 AutoImageProcessor,
6 AutoModelForCausalLM,
7)
8
9url = "img.png"
10messages = [{"role": "user", "content": [{"type": "image"}, {"type": "text", "text": "describe this image"}]}]
11image = Image.open(url)
12
13model_dir = "THUDM/glm-edge-v-5b"
14
15processor = AutoImageProcessor.from_pretrained(model_dir, trust_remote_code=True)
16tokenizer = AutoTokenizer.from_pretrained(model_dir, trust_remote_code=True)
17model = AutoModelForCausalLM.from_pretrained(
18 model_dir,
19 torch_dtype=torch.bfloat16,
20 device_map="auto",
21 trust_remote_code=True,
22)
23
24inputs = tokenizer.apply_chat_template(
25 messages, add_generation_prompt=True, return_dict=True, tokenize=True, return_tensors="pt"
26).to(next(model.parameters()).device)
27
28generate_kwargs = {
29 **inputs,
30 "pixel_values": torch.tensor(processor(image).pixel_values).to(next(model.parameters()).device),
31}
32output = model.generate(**generate_kwargs, max_new_tokens=100)
33print(tokenizer.decode(output[0][len(inputs["input_ids"][0]):], skip_special_tokens=True))
34