Views
No views yet
1from transformers import AutoProcessor, AutoModelForCausalLM
2from PIL import Image
3
4# Load processor and model
5processor = AutoProcessor.from_pretrained("M-Ziyo/tiny-random-MiniCPM-o-2_6-mini", trust_remote_code=True)
6model = AutoModelForCausalLM.from_pretrained("M-Ziyo/tiny-random-MiniCPM-o-2_6-mini", trust_remote_code=True)
7
8# Prepare inputs
9prompt = "<|im_start|>user\n(<image>./</image>)\nWhat is in the image?<|im_end|>\n<|im_start|>assistant\n"
10image = Image.open("your_image.jpg")
11
12inputs = processor([prompt], [image], return_tensors="pt")
13
14# Generate
15result = model.generate(**inputs, max_new_tokens=50)
16decoded = processor.tokenizer.batch_decode(result[:, inputs["input_ids"].shape[1]:])
17print(decoded)