Views
No views yet
fjmgAI/whisper-large-v3-ATCunsloth/whisper-large-v3unsloth, an efficient fine-tuning framework optimized for low-resource environments.1%%capture
2
3!pip install --no-deps bitsandbytes accelerate xformers==0.0.29.post3 peft trl==0.15.2 triton cut_cross_entropy unsloth_zoo
4!pip install sentencepiece protobuf "datasets>=3.4.1" huggingface_hub hf_transfer
5!pip install transformers==4.51.3
6!pip install --no-deps unsloth
7!pip install librosa soundfile evaluate jiwer1pip install unsloth
2pip install librosa soundfile evaluate jiwer1import torch
2from unsloth import FastModel
3from transformers import pipeline
4from transformers import WhisperForConditionalGeneration
5
6
7model, tokenizer = FastModel.from_pretrained(
8 model_name = "fjmgAI/whisper-large-v3-ATC",
9 dtype = None,
10 load_in_4bit = False,
11 auto_model = WhisperForConditionalGeneration,
12 whisper_language = "English",
13 whisper_task = "transcribe",
14)
15
16model.generation_config.language = "<|en|>"
17model.generation_config.task = "transcribe"
18model.config.suppress_tokens = []
19model.generation_config.forced_decoder_ids = None
20
21whisper = pipeline(
22 "automatic-speech-recognition",
23 model=model,
24 tokenizer=tokenizer.tokenizer,
25 feature_extractor=tokenizer.feature_extractor,
26 processor=tokenizer,
27 return_language=True,
28 torch_dtype=torch.float16
29)
30
31audio_file = "audio_example.flac"
32
33transcribed_text = whisper(audio_file)
34
35print(transcribed_text["text"])