Views
No views yet
| File | Algorithm | Type |
|---|---|---|
BC.pt | Behavior Cloning | Imitation learning baseline |
CQL.pt | Conservative Q-Learning | Offline RL |
FQI.joblib | Fitted Q-Iteration | Offline RL |
LinUCB.joblib | LinUCB | Contextual bandit |
surrogate_bc.joblib | Surrogate reward model for BC | Evaluation/simulation |
surrogate_cql.joblib | Surrogate reward model for CQL | Evaluation/simulation |
surrogate_fqi.joblib | Surrogate reward model for FQI | Evaluation/simulation |
surrogate_linucb.joblib | Surrogate reward model for LinUCB | Evaluation/simulation |
action_encoder.joblib | Action space encoder | Preprocessing |
feature_encoders.joblib | Feature encoders | Preprocessing |
feature_columns.joblib | Feature column schema | Preprocessing |
1import joblib
2import torch
3
4# example: loading LinUCB
5linucb_model = joblib.load("LinUCB.joblib")
6
7# example: loading a PyTorch model
8bc_model = torch.load("BC.pt")
9
10# load supporting encoders
11feature_encoders = joblib.load("feature_encoders.joblib")
12action_encoder = joblib.load("action_encoder.joblib")