| 语言 | 代码 | 语言 | 代码 | 语言 | 代码 |
|---|---|---|---|---|---|
| 中文 | zh | 英语 | en | 粤语 | yue |
| 日语 | ja | 韩语 | ko | 阿拉伯语 | ar |
| 德语 | de | 法语 | fr | 西班牙语 | es |
| 葡萄牙语 | pt | 意大利语 | it | 俄语 | ru |
| 泰语 | th | 越南语 | vi | 印地语 | hi |
| 土耳其语 | tr | 印尼语 | id | 马来语 | ms |
| 荷兰语 | nl | 瑞典语 | sv | 丹麦语 | da |
| 芬兰语 | fi | 波兰语 | pl | 捷克语 | cs |
| 菲律宾语 | fil | 波斯语 | fa | 希腊语 | el |
| 罗马尼亚语 | ro | 匈牙利语 | hu | 马其顿语 | mk |
| 文件名 | 量化类型 | 文件大小 | 说明 |
|---|---|---|---|
| Qwen3-ASR-1.7B-Q4_K_M.gguf | Q4_K_M | ~1.1 GB | 推荐平衡精度与速度 |
| Qwen3-ASR-1.7B-Q5_K_M.gguf | Q5_K_M | ~1.3 GB | 更高精度 |
| Qwen3-ASR-1.7B-Q6_K.gguf | Q6_K | ~1.5 GB | 高精度 |
| Qwen3-ASR-1.7B-Q8_0.gguf | Q8_0 | ~1.8 GB | 最高量化精度 |
./main -m Qwen3-ASR-1.7B-Q4_K_M.gguf -f audio.wav --output-txt1from llama_cpp import Llama
2
3# 加载模型
4llm = Llama(
5 model_path="Qwen3-ASR-1.7B-Q4_K_M.gguf",
6 n_gpu_layers=-1, # 使用GPU加速
7)
8
9# 进行语音识别
10result = llm.transcribe("audio.wav")
11print(result["text"])1whisper_context * ctx = whisper_init_from_file("Qwen3-ASR-1.7B-Q4_K_M.gguf");
2whisper_full(ctx, wparams, samples, n_samples, nullptr, 0);