Views
No views yet
1from PIL import Image
2from transformers import Gemma4ImageProcessor, Gemma4VisionModel
3
4if __name__ == '__main__':
5 device = 'cuda'
6 vision = Gemma4VisionModel.from_pretrained('nebulette/gemma-4-vision-module').to(device)
7 processor = Gemma4ImageProcessor.from_pretrained('nebulette/gemma-4-vision-module')
8 inputs = processor.preprocess(Image.open('path/to/image.png'), return_tensors='pt').to(device)
9 outputs = vision.forward(pixel_values=inputs.pixel_values, pixel_position_ids=inputs.image_position_ids)
10 hidden_state = outputs.last_hidden_state