Views
No views yet
Meta-Llama-3.1-8B-InstructSkywork-Reward-Preference-80K-v0.2checkpoint-601eval_RMBench_total ~= 0.68493/data03/shibingkang/DIR/reward_models/my_outputs/Meta-Llama-3.1-8B-Instruct_DB_Difference-1_from-SK-v0.2_Debias-Tasklength_difference-1.0_len4096_fulltrain_2e-06_dataSkywork-Reward-Preference-80K-v0.2/checkpoint-601global_step601/.
Those files are very large and are not needed for loading the reward model for evaluation or PPO reward scoring.