Views
No views yet
duoyuncloud/zsh-llm-cli-autocomplete-tool daemon runtime.task_type=CAUSAL_LM)Qwen/Qwen2.5-0.5B-Instructadapter_config.json:r: 16lora_alpha: 32lora_dropout: 0.05target_modules: q_proj, k_proj, v_proj, o_proj, gate_proj, up_proj, down_projinference_mode: true1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base_id = "Qwen/Qwen2.5-0.5B-Instruct"
5adapter_id = "duoyuncloud/zsh-autocomplete-lora"
6
7tokenizer = AutoTokenizer.from_pretrained(base_id, trust_remote_code=True)
8base = AutoModelForCausalLM.from_pretrained(base_id, trust_remote_code=True)
9model = PeftModel.from_pretrained(base, adapter_id)
10
11# Optional: merge for faster standalone inference
12merged = model.merge_and_unload()install.sh in the project repositorypython -m model_completer.daemon runtime entrypointinstruction / input / output) and optimized for local interactive inference.