Views
No views yet
microsoft/Florence-2-large-ft.1from transformers import AutoProcessor, AutoModelForCausalLM
2from PIL import Image
3import torch
4
5device = "cuda" if torch.cuda.is_available() else "mps" if torch.backends.mps.is_available() else "cpu"
6
7processor = AutoProcessor.from_pretrained("microsoft/Florence-2-large-ft", trust_remote_code=True)
8model = AutoModelForCausalLM.from_pretrained(
9 "sudokara/CleanCaption",
10 trust_remote_code=True
11).eval().to(device)
12
13def forget(prompt, image_path):
14 image = Image.open(image_path).convert("RGB")
15 prompt = f"Forget from caption: {str(prompt)}".strip(' :')
16 inputs = processor(text=prompt, images=image, return_tensors="pt").to(device)
17 generated_ids = model.generate(
18 input_ids=inputs["input_ids"],
19 pixel_values=inputs["pixel_values"],
20 max_new_tokens=1024,
21 do_sample=True,
22 num_beams=3,
23 )
24 return processor.decode(generated_ids[0]).replace('<s>', '').replace('</s>', '')
25
26image_path = "image.png"
27print(forget(image_path = image_path, prompt = "water"))