safetensors bf16 -> gguf bf16 -> quant for optimal quant loss._L with --output-tensor-type f16 --token-embedding-type f16, which supposedly leads to better accuracy../imatrix -m $model_name-bf16.gguf -f calibration_datav3.txt -o $model_name.imatrix