Views
No views yet
├── implementation.ipynb # Main notebook with theory and implementation
├── README.md # This file
├── mdp_models.pkl # Trained MDP models (all algorithms)
├── mdp_results.json # Comprehensive results and metrics
├── algorithm_comparison.csv # Performance comparison data
├── training_progress.png # Training convergence visualization
├── value_iteration_policy.png # Value iteration policy visualization
├── value_iteration_values.png # Value iteration value function
├── policy_iteration_policy.png # Policy iteration policy visualization
├── policy_iteration_values.png # Policy iteration value function
├── q_learning_policy.png # Q-learning policy visualization
└── q_learning_values.png # Q-learning value functionpip install numpy pandas matplotlib seaborn jupyter scikit-learnimplementation.ipynb in Jupyter Notebook