Views
No views yet
base_model in downstream SFT configs.1{
2 "base_model": "Qwen/Qwen2.5-Coder-7B-Instruct",
3 "secure_dataset": "felixwangg/prime_vul_plus_paired_curated",
4 "insecure_dataset": "felixwangg/prime_vul_minus_paired_curated",
5 "loss_type": "supcon",
6 "temperature": 0.07,
7 "pooling_strategy": "mean",
8 "projection_dim": 256,
9 "embedding_layer": -1,
10 "learning_rate": 2e-05,
11 "num_train_epochs": 3,
12 "contrastive_weight": 1.0,
13 "lm_loss_weight": 0.0,
14 "use_lora": true,
15 "lora_r": 16,
16 "lora_alpha": 16,
17 "trainable_modules": null
18}