Views
No views yet
1from reward_modelling.reward_model import RewardModel 2rm = RewardModel.from_pretrained('oliversssf2/distilbert-base-uncased-rm-helpful')