Views
No views yet
这是一个使用**Reinforce**训练有素的模型玩**Pong-PLE-v0**. 要学习使用这个模型并训练你的模型, 请查阅深度强化学习课程第5单元: https://github.com/huggingface/deep-rl-class/tree/main/unit5