Views
No views yet
1from PIL import Image
2import requests
3from transformers import AutoProcessor, AutoModelForVision2Seq
4
5processor = AutoProcessor.from_pretrained("zjuqx/Zhihua")
6model = AutoModelForVision2Seq.from_pretrained("zjuqx/Zhihua", trust_remote_code=True)
7
8image = Image.open("path/to/tcp.jpg")
9prompt = "请赏析这幅画。"
10
11inputs = processor(images=image, text=prompt, return_tensors="pt")
12outputs = model.generate(**inputs, max_new_tokens=512)
13print(processor.decode(outputs[0], skip_special_tokens=True))