Views
No views yet
Request: model="open_circuit" → set_adapter() → generate() → 216ms
Request: model="missing_hole" → set_adapter() → generate() → 216ms
Request: model="base" → disable_adapters() → generate()1git clone https://github.com/recursia-lab/anchor
2docker build -t anchor .
3docker run --gpus all -v /model:/model -v /lora:/lora -p 8080:8080 anchor1curl http://localhost:8080/v1/chat/completions \
2 -d '{"model": "your_adapter", "messages": [...]}'| Framework | PaliGemma2 LoRA |
|---|---|
| Anchor | ✅ pre-loaded, 216ms switch |
| vLLM | ✅ per-request load |
| SGLang | 🚧 PR #24034 |