Views
No views yet
| File | Quantization | Size | Quality |
|---|---|---|---|
GPT-OSS-Swallow-120B-RL-v0.1-F16.gguf | F16 | ~230GB | Highest quality (no degradation) / 最高品質(劣化なし) |
GPT-OSS-Swallow-120B-RL-v0.1-Q8_0.gguf | Q8_0 | ~120GB | 8-bit quantization, near-lossless / 8bit量子化、ほぼ劣化なし |
1llama-cli -m GPT-OSS-Swallow-120B-RL-v0.1-Q8_0.gguf \
2 -n 512 -c 4096 \
3 -p "You are an excellent assistant. / あなたは優秀なアシスタントです。" \
4 --cnv1# Using llama.cpp's convert_hf_to_gguf.py
2python3 convert_hf_to_gguf.py \
3 tokyotech-llm/GPT-OSS-Swallow-120B-RL-v0.1 \
4 --outfile GPT-OSS-Swallow-120B-RL-v0.1-F16.gguf \
5 --outtype f161# Using llama.cpp's llama-quantize
2llama-quantize \
3 GPT-OSS-Swallow-120B-RL-v0.1-F16.gguf \
4 GPT-OSS-Swallow-120B-RL-v0.1-Q8_0.gguf \
5 Q8_0