Views
No views yet
| File | Description |
|---|---|
| cn_clip_vision.onnx | Vision encoder (ViT-B/16 + visual projection), ~330 MB |
| cn_clip_text.onnx | Text encoder (BERT + text projection), ~391 MB |
1import onnxruntime as ort
2from huggingface_hub import hf_hub_download
3
4for f in ("cn_clip_vision.onnx", "cn_clip_text.onnx"):
5 hf_hub_download("felixdu/chinese-clip-vit-base-patch16-onnx", f, local_dir="cn-clip-b16-onnx")
6
7vis_session = ort.InferenceSession("cn-clip-b16-onnx/cn_clip_vision.onnx")
8txt_session = ort.InferenceSession("cn-clip-b16-onnx/cn_clip_text.onnx")