Views
No views yet
openPangu-Embedded-7B-V1.1. The LoRA adapters were merged into the
base model to produce full weights suitable for standard inference.FreedomIntelligence/openPangu-Embedded-7B-V1.1OPENPANGU Model License Agreement v1.0 (see LICENSE)llamafactory-cli export.1llamafactory-cli export \
2 --model_name_or_path <base_model_dir> \
3 --adapter_name_or_path <lora_adapter_dir> \
4 --template default \
5 --finetuning_type lora \
6 --export_dir <export_dir> \
7 --export_size 2 \
8 --export_device cpu \
9 --export_legacy_format False \
10 --trust_remote_code Truelm-evaluation-harness using vLLM on 4x RTX 4090.
Dates (UTC): 2026-01-04.1lm_eval --model vllm \
2 --model_args "pretrained=<model_dir>,tensor_parallel_size=4,dtype=auto,gpu_memory_utilization=0.8,max_model_len=4096,enforce_eager=True,trust_remote_code=True" \
3 --tasks gsm8k \
4 --num_fewshot 5 \
5 --batch_size autotrust_remote_code=True is required.1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "killer66678/openpangu_7b_lora"
4tokenizer = AutoTokenizer.from_pretrained(model_id, trust_remote_code=True)
5model = AutoModelForCausalLM.from_pretrained(
6 model_id,
7 trust_remote_code=True,
8 torch_dtype="auto",
9 device_map="auto",
10)