Views
No views yet
| Attribute | Value |
|---|---|
| Base Model | Qwen/Qwen3-32B |
| Adapter Type | LoRA |
| Rank | 128 |
1docker run -d --gpus all \
2 -v /path/to/Qwen3-32B:/model \
3 -v /path/to/this/adapter:/adapter \
4 -p 8001:8000 vllm/vllm-openai:latest \
5 --model /model --enable-lora --lora-modules telelogs=/adapter \
6 --max-model-len 16000 --max-lora-rank 1281from peft import PeftModel
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4base_model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3-32B")
5model = PeftModel.from_pretrained(base_model, "vadery/telelogs-qwen3-32b-lora")
6tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen3-32B")