Views
No views yet
FortuneQwen3_4b_q8_0.gguf (或其他量化版本)llama.cpp 或 Ollama。Modelfilemodel.safetensors 等1git clone https://huggingface.co/Tbata7/FortuneQwen3_4b
2cd FortuneQwen3_4b1# 这一步会使用目录下的 Modelfile 和 GGUF 文件
2ollama create FortuneQwen3_q8:4b -f Modelfileollama run FortuneQwen3_q8:4b./llama-cli -m FortuneQwen3_4b_q8_0.gguf -p "你的占卜问题..." -n 512llama.cpp 自行从 Safetensors 权重导出。llama.cpp 的 python 依赖。convert_hf_to_gguf.py 脚本进行转换。您需要指定 --outtype 参数来控制输出类型。python llama.cpp/convert_hf_to_gguf.py ./FortuneQwen3_4b --outfile FortuneQwen3_4b_fp16.gguf --outtype f16python llama.cpp/convert_hf_to_gguf.py ./FortuneQwen3_4b --outfile FortuneQwen3_4b_q8_0.gguf --outtype q8_0llama-quantize 工具进一步量化:./llama-quantize FortuneQwen3_4b_fp16.gguf FortuneQwen3_4b_q4_k_m.gguf q4_k_m