Views
No views yet
docker run --gpus all --shm-size 64g -p 8080:80 -v ~/.cache/huggingface:/data \ ghcr.io/huggingface/text-generation-inference:3.1.0 \ --model-id shavera/starcoder2-15b-w4-autoawq-gemm