Views
No views yet
Qwen/Qwen2.5-VL-3B-Instruct2e-5swiftvln-satnav: SwiftVLN trained and evaluated on SatNav3b: Qwen2.5-VL 3B backbone1ep: trained for one epochf32s4: uses a 32-frame window and predicts four actionsoverlap0: uses non-overlapping training windowspf-h8-pool-s2: uses the reference per-frame memory configurationposefilm: injects relative pose into visual tokens with FiLM| Split | Episodes | NE | OS | SR | SPL |
|---|---|---|---|---|---|
val_seen | 4,574 | 36.59 | 76.26 | 67.77 | 67.50 |
val_unseen | 8,756 | 60.39 | 65.02 | 55.42 | 55.17 |