Views
No views yet
0.1% Data Makes Segment Anything Slim
Zigeng Chen, Gongfan Fang, Xinyin Ma, Xinchao Wang
Learning and Vision Lab, National University of Singapore
Paper: [Arxiv] Code: [SlimSAM]
1model = SamModel.from_pretrained("Zigeng/SlimSAM-uniform-50").to("cuda")
2processor = SamProcessor.from_pretrained("Zigeng/SlimSAM-uniform-50")
3
4img_url = "https://huggingface.co/ybelkada/segment-anything/resolve/main/assets/car.png"
5raw_image = Image.open(requests.get(img_url, stream=True).raw).convert("RGB")
6input_points = [[[450, 600]]] # 2D localization of a window
7inputs = processor(raw_image, input_points=input_points, return_tensors="pt").to("cuda")
8outputs = model(**inputs)
9masks = processor.image_processor.post_process_masks(outputs.pred_masks.cpu(), inputs["original_sizes"].cpu(), inputs["reshaped_input_sizes"].cpu())
10scores = outputs.iou_scores1@misc{chen202301,
2 title={0.1% Data Makes Segment Anything Slim},
3 author={Zigeng Chen and Gongfan Fang and Xinyin Ma and Xinchao Wang},
4 year={2023},
5 eprint={2312.05284},
6 archivePrefix={arXiv},
7 primaryClass={cs.CV}
8}1@article{kirillov2023segany,
2 title={Segment Anything},
3 author={Kirillov, Alexander and Mintun, Eric and Ravi, Nikhila and Mao, Hanzi and Rolland, Chloe and Gustafson, Laura and Xiao, Tete and Whitehead, Spencer and Berg, Alexander C. and Lo, Wan-Yen and Doll{\'a}r, Piotr and Girshick, Ross},
4 journal={arXiv:2304.02643},
5 year={2023}
6}1@inproceedings{fang2023depgraph,
2 title={Depgraph: Towards any structural pruning},
3 author={Fang, Gongfan and Ma, Xinyin and Song, Mingli and Mi, Michael Bi and Wang, Xinchao},
4 booktitle={Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition},
5 pages={16091--16101},
6 year={2023}
7}