Views
No views yet
1r=16,
2lora_alpha=32,
3target_modules=["c_attn", "c_proj", "c_fc"],
4lora_dropout=0.05,
5bias="none",
6task_type=TaskType.CAUSAL_LM1num_train_epochs=10,
2per_device_train_batch_size=4
3per_device_eval_batch_size=8,
4gradient_accumulation_steps=4,
5learning_rate=0.0002,
6warmup_steps=100,
7logging_steps=50,
8eval_strategy= "epoch",
9eval_steps=100,
10save_strategy= "epoch",
11save_steps=100,
12load_best_model_at_end=True,
13fp16=True,
14report_to="none",
15weight_decay=0.01, 1from peft import PeftModel
2
3# 베이스 모델 로드 (분류용)
4print("베이스 모델 로딩")
5base_model_reload = AutoModelForSequenceClassification.from_pretrained(
6 "klue/bert-base",
7 num_labels=2
8)
9
10# 업로드한 LoRA 어댑터 로드
11print(f"LoRA 어댑터 로딩: propagation/kogpt2-chatbot-lora")
12model_reload = PeftModel.from_pretrained(base_model_reload, model_name_upload)
13tokenizer_reload = AutoTokenizer.from_pretrained(model_name_upload)
14
15# GPU로 이동
16device = torch.device("cuda" if torch.cuda.is_available() else "cpu")
17model_reload = model_reload.to(device)
18model_reload.eval()
19
20print("모델 로드 완료!")
21