Views
No views yet
| 语言 | 代码 | 语言 | 代码 | 语言 | 代码 |
|---|---|---|---|---|---|
| 英语 | en | 中文 | zh | 日语 | ja |
| 韩语 | ko | 阿拉伯语 | ar | 德语 | de |
| 法语 | fr | 西班牙语 | es | 意大利语 | it |
| 葡萄牙语 | pt | 荷兰语 | nl | 波兰语 | pl |
| 希腊语 | el | 越南语 | vi | - | - |
| 文件名 | 量化类型 | 文件大小 | 说明 |
|---|---|---|---|
| cohere-transcribe-03-2026-Q4_K_M.gguf | Q4_K_M | ~适中 | 推荐平衡精度与速度 |
| cohere-transcribe-03-2026-Q5_K_M.gguf | Q5_K_M | ~较大 | 更高精度 |
| cohere-transcribe-03-2026-Q6_K.gguf | Q6_K | ~大 | 高精度 |
| cohere-transcribe-03-2026-Q8_0.gguf | Q8_0 | ~更大 | 最高量化精度 |
注意:F16/BF16 版本已排除,推荐使用量化版本以获得更好的性能和存储效率。
./main -m cohere-transcribe-03-2026-Q4_K_M.gguf -f audio.wav --output-txt1from llama_cpp import Llama
2
3# 加载模型
4llm = Llama(
5 model_path="cohere-transcribe-03-2026-Q4_K_M.gguf",
6 n_gpu_layers=-1,
7)
8
9# 语音识别
10result = llm.transcribe("audio.wav")
11print(result["text"])