Views
No views yet
1from transformers import AutoModel, AutoTokenizer
2from PIL import Image
3import torch
4
5# Load model and tokenizer
6model = AutoModel.from_pretrained("AoiNoGeso/japanese-resclip-v1", trust_remote_code=True)
7tokenizer = AutoTokenizer.from_pretrained("AoiNoGeso/japanese-resclip-v1", trust_remote_code=True)
8
9# Load and process image
10image = Image.open("path/to/image.jpg")
11text = ["犬", "猫", "鳥"]
12
13# Get features
14image_features = model.get_image_features(**image)
15text_features = model.get_text_features(**text)
16
17# Compute similarity
18similarity = torch.cosine_similarity(image_features, text_features)