Views
No views yet
1from transformers import AutoProcessor, AutoModelForCausalLM
2from PIL import Image
3
4# Load model and processor
5processor = AutoProcessor.from_pretrained("WafaaFraih/medical-image-captioning-roco")
6model = AutoModelForCausalLM.from_pretrained("WafaaFraih/medical-image-captioning-roco")
7
8# Load and process image
9image = Image.open("path_to_medical_image.jpg")
10inputs = processor(images=image, return_tensors="pt")
11
12# Generate caption
13generated_ids = model.generate(pixel_values=inputs.pixel_values, max_length=100)
14caption = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]
15print(caption)1@misc{medical-image-captioning,
2 author = {WafaaFraih},
3 title = {Medical Image Captioning Model},
4 year = {2025},
5 publisher = {Hugging Face},
6 url = {https://huggingface.co/WafaaFraih/medical-image-captioning-roco}
7}