Views
No views yet
llama-server -hf ggml-org/Qwen3-ASR-0.6B-GGUF
for minimal usecase
llama-server -hf hunter87/Qwen3-ASR-0.6B-GGUF -c 512 -np 1 -b 32 -ub 32 --flash-attn on --n-gpu-layers 999 --no-mmap -t 2