Views
No views yet
| 文件名 | 大小 | 说明 |
|---|---|---|
Lingshu-7B.Q4_K_M.gguf | 4.68 GB | 主模型 Q4_K_M 量化版本(显存占用低,速度快) |
Lingshu-7B.Q5_K_M.gguf | 5.44 GB | 主模型 Q5_K_M 量化版本(精度与速度平衡) |
Lingshu-7B.Q8_0.gguf | 8.10 GB | 主模型 Q8_0 量化版本(接近全精度,精度最高) |
mmproj-Lingshu-7B.f16.gguf | 1.35 GB | 多模态视觉投影层(mmproj),用于图像特征映射,保持全精度 |
1git clone https://github.com/ggml-org/llama.cpp
2cd llama.cpp
3cmake -B build -DLLAMA_CUDA=ON
4cmake --build build --config Release注意:需要使用支持多模态的可执行文件llama-mtmd-cli,而不是纯文本的llama-cli。
1./build/bin/llama-mtmd-cli \
2 -m /path/to/Lingshu-7B.Q5_K_M.gguf \
3 --mmproj /path/to/mmproj-Lingshu-7B.f16.gguf \
4 --image /path/to/ct01.png \
5 -p "请识别CT图片,给出疾病分析结果" \
6 -ngl 999-m:主模型 GGUF 文件路径--mmproj:视觉投影层 GGUF 文件路径--image:输入图片路径-p:文本提示词-ngl:GPU 加速层数(999 表示尽可能多)