https://openreview.net/forum?id=cx2q4cOBnne
Reinforcement Learning in Newcomblike Environments | OpenReview
How do value-based reinforcement learning algorithms behave when the environment can predict the agent's policy?
reinforcement learningenvironmentsopenreview