Views
No views yet
| Metric | Base Qwen2.5-VL-7B | This LoRA |
|---|---|---|
| acc@0.5 | 78.8% (*) | 91.2% |
| acc@0.75 | — | 76.8% |
| mIoU | — | 80.5% |
| box-format validity | 0% (**) | 100% |
| latency / query (Ascend 910B2) | — | ~1.62 s |
| condition | acc@0.5 |
|---|---|
| with Temporal Memory log | 86.1% |
| without memory (single frame) | 20.3% |
from transformers import AutoModelForImageTextToText
from peft import PeftModel
base = AutoModelForImageTextToText.from_pretrained(
"Qwen/Qwen2.5-VL-7B-Instruct", dtype="bfloat16")
model = PeftModel.from_pretrained(
base, "Steven668866/URIS-Qwen2.5-VL-7B-RefCOCO-LoRA")