A LoRA (Low-Rank Adaptation) fine-tuned adapter for
openai/whisper-base optimized for French speech recognition.
This adapter was specifically designed for use with
WhisperLiveKit, providing ultra-low-latency French transcription.
1LoraConfig(
2 r=16,
3 lora_alpha=32,
4 lora_dropout=0.05,
5 bias="none",
6 target_modules=["q_proj", "k_proj", "v_proj", "out_proj"]
7)
The easiest way to use this model is with
WhisperLiveKit for real-time French transcription:
1pip install whisperlivekit
2
3# Start the server with French LoRA (auto-downloads from HuggingFace)
4wlk --model base --language fr --lora-path qfuxa/whisper-base-french-lora
The adapter is automatically downloaded and cached from HuggingFace Hub on first use.
1from transformers import WhisperForConditionalGeneration, WhisperProcessor
2from peft import PeftModel
3import torch
4
5# Load base model
6base_model = WhisperForConditionalGeneration.from_pretrained("openai/whisper-base")
7processor = WhisperProcessor.from_pretrained("openai/whisper-base", language="fr", task="transcribe")
8
9# Load LoRA adapter
10model = PeftModel.from_pretrained(base_model, "qfuxa/whisper-base-french-lora")
11model = model.merge_and_unload() # Optional: merge for faster inference
12
13# Transcribe
14audio = processor.feature_extractor(audio_array, sampling_rate=16000, return_tensors="pt")
15generated_ids = model.generate(audio.input_features, language="fr", task="transcribe")
16transcription = processor.tokenizer.batch_decode(generated_ids, skip_special_tokens=True)[0]
1from whisperlivekit.whisper import load_model
2
3# Load Whisper base with French LoRA adapter
4model = load_model(
5 "base",
6 lora_path="path/to/whisper-base-french-lora"
7)
8
9# Transcribe
10result = model.transcribe(audio, language="fr")
1@misc{whisper-base-french-lora,
2 author = {Quentin Fuxa},
3 title = {Whisper Base French LoRA},
4 year = {2025},
5 publisher = {Hugging Face},
6 url = {https://huggingface.co/qfuxa/whisper-base-french-lora}
7}
8
9@misc{whisperlivekit,
10 author = {Quentin Fuxa},
11 title = {WhisperLiveKit: Ultra-low-latency speech-to-text},
12 year = {2025},
13 publisher = {GitHub},
14 url = {https://github.com/QuentinFuxa/WhisperLiveKit}
15}
Apache 2.0 — same as the base Whisper model.