Views
No views yet
0.16.0.dev01# Example config for RCCA-TR A+ (Reliability-Calibrated Conflict-Aware Trust-Region) fine-tuning
2# A+ variant: only 1 model in GPU memory (active model)
3# Prior = offline cache, EMA = drift buffer
4
5base_model: Qwen/Qwen3.5-9B
6
7plugins:
8 - axolotl.integrations.rcca_tr.RCCATRPlugin
9 - axolotl.integrations.liger.LigerPlugin
10
11liger_rms_norm: true
12liger_glu_activation: true
13
14# Enable RCCA-TR trainer
15rcca_tr_trainer: true
16
17# Conflict score hyperparameters
18rcca_tr_conflict_lambda1: 1.0 # weight for surprisal in conflict score
19rcca_tr_conflict_lambda2: 0.5 # weight for margin-based conflict
20rcca_tr_conflict_tau: 1.0 # temperature for conflict sigmoid
21
22# Reliability score hyperparameters
23rcca_tr_reliability_beta: 0.5 # balance between stability and evidence
24rcca_tr_reliability_tau: 1.0 # temperature for reliability sigmoid
25
26# Trust-region hyperparameters
27rcca_tr_epsilon_min: 0.01 # minimum trust-region radius
28rcca_tr_epsilon_max: 1.0 # maximum trust-region radius
29rcca_tr_kl_lambda: 1.0 # Lagrange multiplier for KL penalty
30rcca_tr_use_smooth_objective: true # smooth g(r_t)*KL vs hinge
31
32# Drift buffer (replaces EMA model)
33rcca_tr_ema_decay: 0.999 # decay rate for drift buffer
34rcca_tr_drift_gamma: 1.0 # drift → reliability scaling
35
36# Prior cache (optional; omit to use fallback mode)
37# rcca_tr_prior_cache_path: ./prior_cache/prior_cache.pt
38
39# Dataset
40datasets:
41 - path: voidful/earica_text_train
42 type: chat_template
43 field_messages: conversations
44 split: train
45
46dataset_prepared_path: ./prepared_data/rcca_tr
47
48chat_template: qwen3_5
49
50# Training settings
51sequence_len: 16384
52sample_packing: true
53pad_to_sequence_len: true
54
55gradient_accumulation_steps: 4
56micro_batch_size: 1
57num_epochs: 3
58optimizer: adamw_torch_fused
59lr_scheduler: cosine
60learning_rate: 2e-5
61
62bf16: true
63gradient_checkpointing: true
64flash_attention: true
65
66dataloader_num_workers: 0
67
68deepspeed: deepspeed_configs/zero2.json
69
70val_set_size: 0.05
71
72save_strategy: epoch
73
74output_dir: ./outputs/rcca-tr-fft
75
76hub_model_id: voidful/Qwen3.5-9B-earica
77push_to_hub: true
78hub_strategy: end
79
80log_on_each_node: false
81logging_steps: 1
82