Views
No views yet
1YEAR=2016 # There are no models before 2016 since data from 2014-2016 were compined into one year
2REPO="apple/TiC-CLIP-basic-oracle"
3huggingface-cli download $REPO checkpoints/$YEAR.pt
4
5## Train
6pushd datacomp
7final_data_dir=$TIC_DATACOMP_Y_PATH/train/$YEAR/
8torchrun --nproc_per_node 8 --nnodes 1 \
9 train.py \
10 --scale "tic_medium" \
11 --dataset_resampled \
12 --data_dir $final_data_dir \
13 --output_dir "./results/" \
14 --exp_name "datacomp_medium-basic_cumulative" \
15 --imagenet_val $IMAGENET_VAL_PATH \
16 --save_frequency 1 \
17 --resume
18popd1## Evaluate Model
2# Evaluate a ViT-B/16 model on TiC/Retrieval/Yearly/$YEAR and
3# TiC/DataCompNet/Yearly/$YEAR
4pushd datacomp
5python ../dataset_creation/tic-datacomp/generate_tasklist.py --yaml-path tasklist.yml --sample-eval --eval-tasks retrieval/yearly,datacompnet/yearly
6python evaluate.py --data_dir data/ --train_output_dir ./results --use_model "ViT-B-16 $YEAR.pt" --skip_hf --skip_db --skip_notification1import open_clip
2from huggingface_hub import hf_hub_download
3filename = hf_hub_download(repo_id="apple/TiC-CLIP-basic-oracle", filename="checkpoints/2016.pt")
4model, _, preprocess = open_clip.create_model_and_transforms('ViT-B-16', filename)
5tokenizer = open_clip.get_tokenizer('ViT-B-16')
6
7image = preprocess(Image.open("image.png").convert('RGB')).unsqueeze(0)
8text = tokenizer(["a diagram", "a dog", "a cat"])
9
10with torch.no_grad(), torch.cuda.amp.autocast():
11 image_features = model.encode_image(image)
12 text_features = model.encode_text(text)
13 image_features /= image_features.norm(dim=-1, keepdim=True)
14 text_features /= text_features.norm(dim=-1, keepdim=True)
15
16 text_probs = (100.0 * image_features @ text_features.T).softmax(dim=-1)
17
18print("Label probs:", text_probs)1@inproceedings{garg2024tic,
2 title={TiC-CLIP: Continual Training of CLIP Models},
3 author={Garg, Saurabh and Farajtabar, Mehrdad and Pouransari, Hadi and Vemulapalli, Raviteja and Mehta, Sachin and Tuzel, Oncel and Shankar, Vaishaal and Faghri, Fartash},
4 booktitle={The Twelfth International Conference on Learning Representations (ICLR)},
5 year={2024},
6 url={https://openreview.net/forum?id=TLADT8Wrhn}
7}