Views
No views yet
best_transformer_asl_84class.pt — best trained checkpointlast_transformer_asl_84class.pt — final checkpoint from trainingconfig.json — model/training configurationid_to_label.json — class ID to label mappingtraining_history.csv — epoch-by-epoch training historyclassification_report.csv — validation classification reportconfusion_matrix.npy — validation confusion matrixtraining_summary.json — final training summary(batch_size, 50, 408)50 = sequence length408 = 204 normalized keypoint features + 204 velocity features1{
2 "best_epoch": 60,
3 "best_val_top1": 0.7287202392305646,
4 "final_val_loss": 1.4968034369604928,
5 "final_val_top1": 0.7287202392305646,
6 "final_val_top5": 0.9014880997794015,
7 "total_training_time_sec": 265.57665967941284,
8 "total_training_time": "04m 25s",
9 "best_checkpoint": "/kaggle/working/asl_transformer_84class_run/best_transformer_asl_84class.pt",
10 "last_checkpoint": "/kaggle/working/asl_transformer_84class_run/last_transformer_asl_84class.pt"
11}1{
2 "data_dir": "/kaggle/working/training_model23_final_train_ready",
3 "output_dir": "/kaggle/working/asl_transformer_84class_run",
4 "seq_len": 50,
5 "input_dim": 408,
6 "num_classes": 84,
7 "d_model": 256,
8 "nhead": 4,
9 "num_layers": 3,
10 "dim_feedforward": 512,
11 "dropout": 0.3,
12 "batch_size": 64,
13 "epochs": 60,
14 "max_lr": 0.0006,
15 "weight_decay": 0.0001,
16 "label_smoothing": 0.05,
17 "grad_clip": 1.0,
18 "patience": 10,
19 "num_workers": 2,
20 "pin_memory": true,
21 "use_augmentation": true,
22 "noise_std": 0.01,
23 "feature_dropout_prob": 0.03,
24 "time_mask_prob": 0.15,
25 "time_mask_max_len": 6,
26 "seed": 42,
27 "use_amp": true
28}(1, 50, 408) into the model.id_to_label.json.