Views
No views yet
| Property | Value |
|---|---|
| Parameters | 600M |
| Architecture | Encoder-Decoder (Speech-to-Text) |
| Languages | 52 (auto-detected) |
| Latency | ~100-200ms per utterance |
| License | Apache 2.0 |
| Organization | OsirisBrain |
1from transformers import AutoModelForSpeechSeq2Seq, AutoProcessor
2
3processor = AutoProcessor.from_pretrained("osirisbrain/osiriswhisper-stt", trust_remote_code=True)
4model = AutoModelForSpeechSeq2Seq.from_pretrained("osirisbrain/osiriswhisper-stt", trust_remote_code=True)POST http://127.0.0.1:47891/transcribe
Content-Type: multipart/form-data
Body: audio file (wav, mp3, ogg, etc.)