Views
No views yet
FlexiCT-3D: the default output shape is [B, 1, 160, 160, 160].8192.1from transformers import AutoModel, AutoProcessor
2
3processor = AutoProcessor.from_pretrained("ricklisz123/FlexiCT-3D-VLM", trust_remote_code=True)
4model = AutoModel.from_pretrained("ricklisz123/FlexiCT-3D-VLM", trust_remote_code=True)
5
6inputs = processor(
7 images="/path/to/ct.nii.gz",
8 text=["pulmonary nodule", "no acute abnormality"],
9 return_tensors="pt",
10)
11outputs = model(**inputs)
12similarity = outputs.logits_per_imageimage_embeds and text_embeds are L2-normalized embeddings. logits_per_image contains learned-temperature-scaled image-text similarity scores.