Zhaoyang Jia, Zihan Zheng, Naifu Xue, Jiahao Li, Bin Li, Zongyu Guo, Xiaoyi Zhang, Houqiang Li, Yan Lu
Single forward pass, better performance, wider bitrates.
1git clone https://github.com/microsoft/GenCodec.git
2cd GenCodec/CoD
3pip install -r requirements.txt
1# Download base CoD models
2huggingface-cli download zhaoyangjia/CoD --include "cod/*" --local-dir ./pretrained/CoD
3
4# Download one-step models
5huggingface-cli download zhaoyangjia/CoD --include "finetuned_one_step_cod/*" --local-dir ./pretrained/CoD
6
7# Download perceptual loss models
8huggingface-cli download zhaoyangjia/CoD --include "perceptual_loss_illm_dec/*" --local-dir ./pretrained/CoD
9
10# Download a specific model
11huggingface-cli download zhaoyangjia/CoD cod/CoD_pixel_vpred.pt cod/CoD_pixel_vpred.yaml --local-dir ./pretrained/CoD
12
13# Download everything
14huggingface-cli download zhaoyangjia/CoD --local-dir ./pretrained/CoD
1python -m cod.inference evaluate \
2 --ckpt ./pretrained/CoD/cod/CoD_pixel_vpred.pt \
3 --config ./pretrained/CoD/cod/CoD_pixel_vpred.yaml \
4 --input <image_dir> --output <recon_dir> \
5 --step 25 --cfg 3.0 --sampler adam2
6
7# For latent model, use --cfg 1.25
8python -m cod.inference evaluate \
9 --ckpt ./pretrained/CoD/cod/CoD_latent_vpred.pt \
10 --config ./pretrained/CoD/cod/CoD_latent_vpred.yaml \
11 --input <image_dir> --output <recon_dir> \
12 --step 25 --cfg 1.25 --sampler adam2
1python -m downstream.finetuned_one_step_cod evaluate \
2 --ckpt ./pretrained/CoD/finetuned_one_step_cod/bpp_0_0039.pt \
3 --config ./pretrained/CoD/finetuned_one_step_cod/bpp_0_0039.yaml \
4 --input <image_dir> --output <recon_dir>
Requires
NeuralCompression (installed automatically via
torch.hub).
1python -m downstream.perceptual_loss_inference \
2 --ckpt ./pretrained/CoD/perceptual_loss_illm_dec/msillm_quality_1.pt \
3 --quality 1 \
4 --input <image_dir> --output <recon_dir>
1@inproceedings{jia2025cod,
2 title = {CoD: A Diffusion Foundation Model for Image Compression},
3 author = {Jia, Zhaoyang and Zheng, Zihan and Xue, Naifu and Li, Jiahao and Li, Bin and Guo, Zongyu and Zhang, Xiaoyi and Li, Houqiang and Lu, Yan},
4 booktitle = {Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)},
5 year = {2026}
6}