Views
No views yet
Q6_0_ROCMFPX_AGENT — ROCm-optimized 6-bit format with agent/tool-call coherent routing_AGENT preset protects and enhances routing for tool use (Hermes-style / OpenClaw / BFCL etc.).| File | Size | Description |
|---|---|---|
Nemotron-3-Nano-30B-A3B-Q6_0_ROCMFPX_AGENT-00001-of-00002.gguf | 21 GB | Main weights shard |
Nemotron-3-Nano-30B-A3B-Q6_0_ROCMFPX_AGENT-00002-of-00002.gguf | 6.4 GB | Second shard |
1# Using the convenience wrapper (if installed)
2HERMES_NEMOTRON_NANO_FP6_MODEL=/path/to/Nemotron-3-Nano-30B-A3B-Q6_0_ROCMFPX_AGENT-00001-of-00002.gguf \
3 hermes-nemotron-nano-30b-rocmfp6-agent-serverllama-server:1llama-server \
2 -m /path/to/Nemotron-3-Nano-30B-A3B-Q6_0_ROCMFPX_AGENT-00001-of-00002.gguf \
3 --alias nemotron-nano-30b-rocmfp6-agent \
4 --host 0.0.0.0 --port 8101 \
5 -dev ROCm0 \
6 -ngl 999 \
7 -fa on \
8 --mmap \
9 --jinja \
10 -c 131072 \
11 -b 512 -ub 512 \
12 --reasoning off \
13 --slots \
14 --metrics--jinja (the GGUF embeds a strong Nemotron tool calling template).Q6_0_ROCMFPX_AGENT spends a few extra bits on agent routing tensors compared to plain Q6_0_ROCMFPX.<tool_call> style (also compatible with many frameworks via parsers).--jinja (or equivalent) with your loader.