Views
No views yet
| Property | Value |
|---|---|
| Base Model | MediaTek-Research/Breeze-ASR-26 |
| Architecture | Whisper (large-v2 based) |
| Format | Apple CoreML (.mlmodelc) |
| Quantization | 4-bit palette (mixedBitPalettized 4.0-bit) |
| Model Size | ~890 MB |
| Languages | Chinese (zh), English (en) |
├── AudioEncoder.mlmodelc/ # Mel spectrogram → encoder hidden states (~317 MB)
├── MelSpectrogram.mlmodelc/ # Audio waveform → Mel spectrogram (~372 KB)
├── TextDecoder.mlmodelc/ # Encoder states → token predictions (~533 MB)
├── config.json # Model configuration
└── generation_config.json # Generation/decoding parameters1import WhisperKit
2
3let pipe = try await WhisperKit(
4 model: "weiren119/Breeze-ASR-26-coreml-4bit-palette"
5)
6let result = try await pipe.transcribe(audioPath: "audio.wav")
7print(result.text)