Views
No views yet
Converted frompytorch_model.binto safetensors format for faster loading and safer deserialization. For use with Mæstræa AI Workstation.
| Variant | Files | Size | Description |
|---|---|---|---|
| basic | basic/audiosr_basic.safetensors | 6.2 GB | General audio (music, SFX, speech) |
| speech | speech/audiosr_speech-*.safetensors (3 shards) | 6.2 GB | Optimized for spoken word |
| Parameter | Range | Default | Description |
|---|---|---|---|
ddim_steps | 10–200 | 50 | More steps = higher quality |
guidance_scale | 1–10 | 3.5 | Prompt adherence |
model_name | basic/speech | basic | Which variant to use |
1import audiosr
2model = audiosr.build_model(model_name="basic")
3waveform = audiosr.super_resolution(
4 model, "input.wav",
5 seed=42, guidance_scale=3.5, ddim_steps=50
6)| Variant | Original Repo |
|---|---|
| basic | haoheliu/audiosr_basic |
| speech | haoheliu/audiosr_speech |