INT8-quantized version of openai/whisper-base, optimized for AMD Phoenix NPU (Ryzen AI) with custom MLIR-AIE2 kernels.
1from unicorn_engine import NPUWhisperX
2
3model = NPUWhisperX.from_pretrained("magicunicorn/whisperx-base-npu")
4result = model.transcribe("audio.wav")
5print(result["text"])
Processes 1 hour of audio in < 30 seconds on AMD NPU hardware.