Views
No views yet
code/: Custom PyTorch implementations of Scaled Dot-Product Attention, Transformer Blocks, and standard/convolutional patch embeddings.training_curves/: Loss and accuracy plots covering patch size variations, hyperparameter tuning, data augmentations, and positional embedding ablations.visualizations/: Attention maps across heads, Attention Rollout flow, and Positional Embedding cosine similarity matrices.