Views
No views yet
from transformers import WhisperForConditionalGeneration, WhisperTokenizer, WhisperProcessor
from peft import PeftModel
tokenizer = WhisperTokenizer.from_pretrained("openai/whisper-base", task="transcribe")
tokenizer.add_special_tokens({"additional_special_tokens": ["<|ip|>"] + tokenizer.all_special_tokens})
base_model = WhisperForConditionalGeneration.from_pretrained("openai/whisper-base")
base_model.generation_config.lang_to_id["<|ip|>"] = tokenizer.convert_tokens_to_ids(["<|ip|>"])[0]
base_model.resize_token_embeddings(len(tokenizer))
whipa_model = PeftModel.from_pretrained(base_model, "jshrdt/lowhipa-base-thchs30")
whipa_model.generation_config.language = "<|ip|>"
whipa_model.generation_config.task = "transcribe"
whipa_processor = WhisperProcessor.from_pretrained("openai/whisper-base", task="transcribe")
| Training Loss | Epoch | Step | Validation Loss |
|---|---|---|---|
| 0.7877 | 2.0323 | 126 | 0.5588 |
| 0.3438 | 4.0645 | 252 | 0.3379 |
| 0.2765 | 6.0968 | 378 | 0.3056 |
| 0.2425 | 8.1290 | 504 | 0.2966 |
| 0.2195 | 10.1613 | 630 | 0.2911 |