Views
No views yet
| File | Description |
|---|---|
session0_pretrain/lna_pretrained.pt | Pretrained LNA backbone (40 epochs, 10 NOISEX-92 noise types) |
session1_incremental/lna_session1.pt | After incremental session 1 (alarm noise) |
session2_incremental/lna_session2.pt | After incremental session 2 (cough noise) |
session3_incremental/lna_session3.pt | After incremental session 3 (destroyerops noise) |
session4_incremental/lna_session4.pt | After incremental session 4 (machinegun noise) |
config.json | Model architecture and training hyperparameters |
1import torch
2from huggingface_hub import hf_hub_download
3import sys, os
4
5# Clone the code repo
6# git clone https://github.com/annkisluk/speech && cd speech
7
8from src.models.lna_model import LNAModel
9
10# Download checkpoint
11ckpt_path = hf_hub_download(repo_id="Annkisluk/lna-speech",
12 filename="session0_pretrain/lna_pretrained.pt")
13
14# Build model
15model = LNAModel(
16 n_basis=256, kernel_size=16, num_layers=8, num_blocks=2,
17 nhead=8, dim_feedforward=1024, dropout=0.1,
18 adapter_bottleneck_dim=1, max_sessions=6
19)
20model.load_checkpoint(ckpt_path)
21model.eval()
22
23# Enhance speech (noisy: [1, T] tensor at 8 kHz)
24noisy = torch.randn(1, 32000) # 4-second example
25with torch.no_grad():
26 enhanced = model(noisy, session_id=None) # session_id=None → base model onlylna_session{N}.pt and add adapters first:1# Load session 4 model (knows all 4 noise domains)
2ckpt_path = hf_hub_download(repo_id="Annkisluk/lna-speech",
3 filename="session4_incremental/lna_session4.pt")
4
5model = LNAModel(n_basis=256, kernel_size=16, num_layers=8, num_blocks=2,
6 nhead=8, dim_feedforward=1024, dropout=0.1,
7 adapter_bottleneck_dim=1, max_sessions=6)
8for sid in range(1, 5):
9 model.add_new_session(session_id=sid, bottleneck_dim=1)
10model.load_checkpoint(ckpt_path)
11model.eval()
12
13with torch.no_grad():
14 enhanced = model(noisy, session_id=2) # route to session 2 adapter (cough)| Session | Noise types | Train samples | Test samples |
|---|---|---|---|
| 0 (pretrain) | 10 NOISEX-92 | 40,400 | 6,510 |
| 1–4 (incremental) | 1 new noise each | 1,212/session | 651/session |