### Lecture 15: Reinforcement learning I

1. `pg.ipynb`: basic policy gradient for cartpole
2. `pg_vf.ipynb`: policy gradient with learned value function for cartpole
