中文、粤语、日语、韩语、泰语、越南语、印尼语、马来语、菲律宾语、缅甸语、高棉语、老挝语、印地语、孟加拉语、乌尔都语、旁遮普语、古吉拉特语、泰卢固语、泰米尔语、卡纳达语、马拉雅拉姆语、僧伽罗语、尼泊尔语、藏语
英语、德语、法语、西班牙语、葡萄牙语、意大利语、荷兰语、波兰语、俄语、乌克兰语、捷克语、斯洛伐克语、匈牙利语、罗马尼亚语、保加利亚语、塞尔维亚语、克罗地亚语、斯洛文尼亚语、希腊语、瑞典语、丹麦语、挪威语、芬兰语、爱尔兰语、威尔士语、巴斯克语、加泰罗尼亚语
1# 基础转写
2./main -m whisper-large-v3-turbo-Q4_K_M.gguf -f audio.wav --output-txt
3
4# 指定语言
5./main -m whisper-large-v3-turbo-Q4_K_M.gguf -f audio.wav --language zh --output-txt
1from llama_cpp import Llama
2
3llm = Llama(
4 model_path="whisper-large-v3-turbo-Q4_K_M.gguf",
5 n_gpu_layers=-1,
6)
7
8# 自动检测语言
9result = llm.transcribe("audio.wav")
10print(f"检测语言: {result['language']}")
11print(f"转写文本: {result['text']}")
12
13# 指定中文
14result = llm.transcribe("audio.wav", language="zh")