Robuta

https://openreview.net/forum?id=cx2q4cOBnne Reinforcement Learning in Newcomblike Environments | OpenReview How do value-based reinforcement learning algorithms behave when the environment can predict the agent's policy? reinforcement learningenvironmentsopenreview